我的 X 阅读
我的关注
科学物理人工智能
神奇小子
动物世界
科学物理人工智能 · 3000 / 3000 条
已同步 74 个列表成员 · 当前内容涉及 65 位作者
更新 10-11 01:42
账号
全部账号
@_jasonwei
@adcock_brett
@agarwl_
@alexandr_wang
@apples_jimmy
@AYi_AInotes
@beffjezos
@bminaiev
@brkthroughprize
@burkov
@cerebras
@chetaslua
@dair_ai
@danielhanchen
@davis7
@deedydas
@DeryaTR_
@drmichaellevin
@fidjissimo
@ForwardEditor
@getjonwithit
@GillVerd
@Google
@haoqik322
@hark_labs
@hsu_steve
@joonas_nattila
@jxmnop
@karpathy
@kaysorin
@KenOno691
@kimmonismus
@LiLiunian
@liquidai
@makeamarkery
@martinmbauer
@Moleh1ll
@N8Programs
@Oct7NeverForget
@OfficialLoganK
@omarsar0
@op7418
@OpenAIDevs
@packyM
@pascalkwanten
@pmddomingos
@polynoamial
@probnstat
@ProfBuehlerMIT
@prz_chojecki
@QFTlover
@ramin_m_h
@rohanpaul_ai
@SakanaAILabs
@sama
@stephen_wolfram
@suvansh
@swyx
@thsottiaux
@TOEwithCurt
@tydsh
@WenhuChen
@wonderofscience
@xiaohu
@ylecun
浏览
最新在前
均衡浏览
搜索
查看
重置
3000 条 · 第 157/200 页 ·
刷新
首页
上一页
下一页
尾页
Chubby
@kimmonismus
10-02 02:03 ·
原帖
据报道,OpenAI解雇了三名安全研究人员,原因是他们涉嫌向一家外部人工智能安全组织泄露机密信息。 据《华尔街日报》报道,这些研究人员隶属于OpenAI的安全团队。OpenAI证实了三名员工的离职,并表示涉事人员“处理不当”。
Rohan Paul
@rohanpaul_ai
10-02 01:59 ·
原帖
转帖:Boris Cherny(Anthropic 的 Claude 代码负责人)今年合并了约 1700 个拉取请求,添加了 40 万行代码,并删除了 25 万行,所有这些都使用 Claude Code 完成。 并且使用了 80 亿个令牌。 “自从 Opus 4.5 发布以来,我 100% 的代码都是由 Claude Code 编写的。那大约是去年 11 月左右。 ... 现在我大部分的编码工作都是在手机上完成的。” --- 来自“Scale”YouTube 频道,(完整视频链接在评论中)
Tibo
@thsottiaux
10-02 01:57 ·
原帖
该死的WiFi 引用:dots demo. 现在……有了更好的WiFi。https://t.co/ucMH7SI1vj
Rohan Paul
@rohanpaul_ai
10-02 01:51 ·
原帖
– https://t.co/IX8SCRa8BC 标题:“Mid-Harness:模型与 Harness 之间动作扩展,用于终端代理”
Rohan Paul
@rohanpaul_ai
10-02 01:51 ·
原帖
英伟达的新论文指出,在给你的智能体更多选项之前,先给它配备一个更优秀的判断者。 一条错误的指令就可能让人工智能智能体偏离正轨,所以让它先拟定几个选项,然后让一个智能判断者在行动前进行筛选。 这样一来,你就能让人工智能智能体更加可靠,而无需依赖 https://t.co/vZuijJoC3R
Rohan Paul
@rohanpaul_ai
10-02 01:44 ·
原帖
一家公司开发出了一个足以以假乱真的模型。 48% 与 Griffin(Tavus 公司的人机交互模型)进行过实时对话的人都认为它是真人。我有幸提前体验了这款模型,对此深表赞同。 在 NVIDIA 的面对面 AI 排行榜上,https://t.co/g2f7xAPcvY
Jimmy Apples /acc
@apples_jimmy
10-02 01:42 ·
原帖
制作一款视觉小说风格的游戏,故事背景是一家位于旧金山实验室公司楼层里的咖啡馆,你必须应对各种角色,比如减速派、加速派、对齐工作人员、记者以及无家可归者。
Rohan Paul
@rohanpaul_ai
10-02 01:42 ·
原帖
转帖:马克·库班利用 AI 打造商业模拟器以测试假设的方法。 创始人现在可以生成一份草稿计划、成本结构、供应商清单和专利大纲。 缩短了灵感与首次认真可行性测试之间的距离。 ---- 来自“Alex Kantrowitz” YouTube 频道,(链接在评论中)
Rohan Paul
@rohanpaul_ai
10-02 01:25 ·
原帖
转帖:dot 是一个有用的名称,用于个人代理,如果你计划推出一个点状硬件设备。
Chubby
@kimmonismus
10-02 01:19 ·
原帖
今天最好的消息:一位 @GoogleDeepMind 的高级员工研究员称 Bloomberg 的报道是“胡说八道”。 Bloomberg 声称,虽然 Gemini 4 “在广泛用于评估模型效能的基准测试中表现良好,但当员工真正将其投入使用时,它的表现就不那么好了”。 所以是的,这给了我们更多理由期待一个伟大的发布。 引用:这个 @Bloomberg 的报道是胡说八道。氩(Argon)已经是我日常使用的工具有一段时间了,体验非常棒。它在代理式调试方面特别出色,当然日常编码任务也同样优秀。
OpenAI Developers
@OpenAIDevs
10-02 01:17 ·
原帖
点状演示。 现在……有了更好的 WiFi。
OpenAI Developers
@OpenAIDevs
10-02 01:07 ·
原帖
转帖:我使用 GPT-6 Astra 破解了一个未解密码,这是拿破仑的一位将军的密码,已经有 217 年未被解读。 真正令人印象深刻的地方并不是破解密码本身,而是 Astra 从一张图片和一个目标出发,在大约 6 小时内完成了整个多模态工作流程。 1/6
Ramin
@ramin_m_h
10-02 01:07 ·
原帖
多重束 RL,使用我们的骏马 LFM 2.6B 这是我们 @huggingface 合作伙伴的一件美丽作品 引用:1/ 兴奋地发布《多 Harness RL 终极指南》 同一个模型在每个代理 harness 中表现不同。因此,我们构建了一种开放的方式,可以在人们实际使用的 harness 中,使用 RL 在任何任务集上训练任何模型,比如 Claude Code、Codex 和 OpenCode,而无需更改一行 harness 或训练代码。 在四个 harness 中训练后,LFM2.5-2.6B 的性能从 42% 提升到 54%,工具调用减少了 31%。
Ramin
@ramin_m_h
10-02 01:06 ·
原帖
转帖:1/ 兴奋地发布《多 Harness RL 终极指南》 同一个模型在每个代理 harness 中表现不同。因此,我们构建了一种开放的方式,可以在人们实际使用的 harness 中,使用 RL 在任何任务集上训练任何模型,比如 Claude Code、Codex 和 OpenCode,而无需更改一行 harness 或训练代码。 在四个 harness 中训练后,LFM2.5-2.6B 的性能从 42% 提升到 54%,工具调用减少了 31%。
Rohan Paul
@rohanpaul_ai
10-02 01:05 ·
原帖
波士顿动力为Atlas配备了新的4指手部,专为使用人类工具而设计,而不仅仅是抓取箱子。 - 生产目标:每年10万只手 - 13个自由度,比旧款3指手的7个自由度增加,因此Atlas现在可以在手中移动物体,而不仅仅是抓握它们 - 无小指:第5根手指会增加3个执行器,并添加另一个可能损坏的部件,工程师们在将自己的小指和无名指用胶带绑在一起一天后一致同意 - 4自由度的对生拇指可以沿每根手指滑动并夹住其中任意一根,这使得手内重新定位和捕捉滑脱的抓握成为可能 - 手指可以向侧面张开,因此手部可以在操作扳机时握住工具柄,涵盖电钻、磨床、钉枪和焊枪 - 它仍然足够强大,能够携带重达100磅以上的满载迷你冰箱 - 每个关节都使用相同的密封直驱电机,没有电缆穿越关节,每个执行器组件作为一个整体更换,因此维修保持快速且廉价 - 它以两种方式感知接触:后驱电机通过关节感知力,而触觉压力传感器覆盖指尖和手掌 - 手部的行为足够可预测,可以精确模拟,因此强化学习可以在虚拟环境中训练它,因为人类可穿戴手套可以记录运动但无法捕捉快速力控制所需的灵巧性 - 仅在模拟中训练的早期策略已经可以在真实手部运行,仅使用电机反馈,尽管波士顿动力称这些为初步结果
首页
上一页
下一页
尾页