我的 X 阅读

我的关注 科学物理人工智能 神奇小子 动物世界

科学物理人工智能 · 3000 / 3000 条

已同步 74 个列表成员 · 当前内容涉及 67 位作者

更新 10-09 13:42

重置

3000 条 · 第 14/200 页 · 刷新

Rohan Paul @rohanpaul_ai
10-08 11:09 · 原帖
埃马德·莫斯塔克:人工智能模型“效率已基本达到人脑水平”。 阿里巴巴的Qwen 27B通常需要约60GB内存,而Prism ML团队通过将数值存储方式从16位改为1.5位,在保持95%性能的同时,将内存占用降低至6GB。 仅需6GB内存 https://t.co/vwp92krhbs
Beff (e/acc) @beffjezos
10-08 11:08 · 原帖
物理和数学学术界逐渐走向衰落 地位博弈往往会以这种方式崩溃 唯一的出路是加速前进 没有人能够阻止知识生产的加速 k/acc
steve hsu @hsu_steve
10-08 11:07 · 原帖
“即刻获得菲尔兹奖,无需任何质疑” 我没有资格评判此事,但这似乎确实是对RH认知的一次质的飞跃。 假设证明正确,这意义非凡。
Beff (e/acc) @beffjezos
10-08 11:05 · 原帖
这太棒了,而且非常符合电子/航空技术。 太空探索需要大量的启动资金,用于数十年的艰苦工程研发。 拥有多家能够将有效载荷送离地球的公司,是文明走向稳健的多行星文明的关键。
Rohan Paul @rohanpaul_ai
10-08 11:05 · 原帖
Emad Mostaque:人工智能模型“效率已基本达到人脑水平”,并举了一个具体例子。 阿里巴巴的 Qwen 27B 通常需要约 60GB 内存,而 Prism ML 团队通过将数字存储方式从 16 位改为 1.5 位,在保持 95% 信息效率的前提下,将其内存占用减少到 6GB。https://t.co/KSZt3h910J
elvis @omarsar0
10-08 11:00 · 原帖
为多模态模型提供工具是否会降低其拒绝有害请求的能力? NVIDIA 的一项新研究(已被 NeurIPS 2026 接收)表明,对于其测试的所有模型,答案是肯定的。 拒绝失败率相对上升高达 68.7%,平均上升 17.7%。 这种下降出现在 Claude Opus 4.6 和 https://t.co/qkB86Jjuob 中。
Beff (e/acc) @beffjezos
10-08 10:53 · 原帖
我的兄弟。
歸藏(guizang.ai) @op7418
10-08 10:44 · 原帖
Codex 今天送重置卡
Rohan Paul @rohanpaul_ai
10-08 10:28 · 原帖
数学家们真是太难熬了。突然间,他们竟然无法容忍人工智能。 数学界真是太不守规矩了。 人类数学协会 (AHM) 批评了 OpenAI 昨天发布的 722 篇数学手稿,并敦促数学家们“停止与 OpenAI 的合作”。(https://t.co/1LFb4atUuq)
BURKOV @burkov
10-08 10:16 · 原帖
以目前前沿模型的视觉推理能力而言,它们根本不可能通过视觉编码创造出能与 Photoshop 相媲美的替代品或 CAD 软件。 而且,与窃取人类文字的便捷性不同,它们无法轻易窃取有用的视觉元素。
歸藏(guizang.ai) @op7418
10-08 10:13 · 原帖
Anthropic 这个 Haiku 5.5 真是盯着中国的这几个甜点级模型打,太恶心了! 我对比了一下它和几个中国竞品的价格和测试评分 从价格来看,它比 DeepSeek-V4.1 flash 和智谱的 GLM 5.3 flash 都便宜 从测试集和一些分数来看,在 Terminal Bench 4.0 上,AA 的测试比 5.3 flash 高一分,也跟 5.3 flash https://t.co/AvGbDCaVOq
BURKOV @burkov
10-08 10:08 · 原帖
如果你正在开发一款面向用户的应用,务必设置代币使用上限,并且永远不要开启“自动充值”功能。否则,你总有一天会醒来,希望这一切都只是一场噩梦。
BURKOV @burkov
10-08 10:07 · 原帖
Codex 6.1 Sol 在高画质设置下计算过度,导致所有操作都极其缓慢。我切换到中画质后,它又能正常使用了。 但我仍然更喜欢 Sonnet 5.5 Extra,它的速度快得让我难以置信它竟然真的解决了问题。
歸藏(guizang.ai) @op7418
10-08 10:03 · 原帖
Anthropic 这个决定真是王炸 他们现在会给每个 Max 和 Team 用户直接送对应额度的 API 金额 我把对应额度和怎么领取做了两张图 这个 API 你在哪里用都行,只要这个产品支持输入 API 结合昨天晚上发布的 haiku 5.5 的价格,这 100 美金相当够用了 这下轮到 OpenAI 难受了 https://t.co/rE2a0YjWLN
DAIR.AI @dair_ai
10-08 10:00 · 原帖
Salesforce AI Research 又发表了一篇精彩的论文。 研究发现,一个拥有 310 亿内存的开源 Gemma-4 Web 代理在包含 9 个应用程序的 WebArena Infinity 测试集中获得了 74.6% 的得分,高于使用浏览器的 Gemini 3 Flash 版本(得分为 70.1%)。 他们并没有在每个步骤或部署阶段都聘请专家评审,就取得了这样的成绩。https://t.co/6N0Acw3xF6