我的 X 阅读

我的关注 科学物理人工智能 神奇小子 动物世界

科学物理人工智能 · 3000 / 3000 条

已同步 74 个列表成员 · 当前内容涉及 67 位作者

更新 10-09 13:12

重置

3000 条 · 第 188/200 页 · 刷新

Beff (e/acc) @beffjezos
09-29 17:46 · 原帖
永不灭亡 始终加速 引用:未知是未来栖息之地 绝不绝望 e/acc
Rohan Paul @rohanpaul_ai
09-29 17:43 · 原帖
完整视频 https://t.co/l4CLJi3G0F
Rohan Paul @rohanpaul_ai
09-29 17:43 · 原帖
“在 2026 年,全球每 10 秒的 token 需求量约为 317 亿。到 2030 年,这一数字将达到 1.27 万亿,增长 40 倍。” ~ 高通首席执行官克里斯蒂亚诺·阿蒙(Cristiano Amon): --- token 的爆发式增长意味着 AI 正在从人类步调的交互转向智能体步调的活动。 每一个有用的行动背后都有一个隐藏的…… https://t.co/ztrvdAf2A7
swyx @swyx
09-29 17:41 · 原帖
转帖:不是 Twitter,但我喜欢 Latent Space 电子邮件通讯 (https://t.co/8wu7yLXOBJ)
AYi @AYi_AInotes
09-29 17:38 · 原帖
转帖:Opus 5.5做视频真的绝了,我的剪映699会员瞬间不香了!! 说回正题,在用交易所的,玩链上 Web3 的,跑量化的,做跨境出海支付的兄弟们,下周这场发布会直接关系到你接下来一年的资金效率和赚钱工具, OKX 第一次像苹果开发布会一样,由 Star Xu 亲自带队,把交易系统,链上生态,AI 交易大脑和全球支付网络四张底牌一次性全亮,时间定在 10 月 6 号新加坡。 这不是那种走过场的行业峰会,也不是单纯的大佬站台聊天, 这回okx把他们全线产品的底层重磅更新、全新产品线和实机 Demo一次性全盘端出来了。 我把官方 Luma 页面和目前剧透的核心议程,提炼出四个最硬核的看点拆给大家: 第一个,Trading 交易系统的代际进化 作为核心基本盘,官方预告了重磅的交易端升级。 高频撮合引擎的延迟、流动性深度、更智能的组合保证金模式,以及普通交易者也能直接上手的专业衍生品工具,现场全是一手实操演示。 第二个,Onchain 链上生态的大一统 从 OKX Web3 钱包到自家的 X Layer 二层网络, 解决目前链上最大的痛点:跨链繁琐、Gas费损耗、私钥管理门槛高。 这次大概率会推出更极致的链上资产聚合和无感跨链解决方案,把多链流动性彻底打通。 第三个,Intelligence 智能与 AI 的真正落地 这是最让人期待的一块。 大模型不仅在写代码,更在重构金融大脑。 OKX 这次把 AI 深度焊进了交易策略、链上异常监控、智能投研和自动化跟单里, 让普通散户也能拥有对齐顶级量化机构的智能助手。 第四个,Money 传统金融与加密资产的融合 数字资产和全球传统资金流动正在加速并轨。 支付、合规通道、法币出入金体验、以及机构级的资金管理, 在新加坡这个全球合规金融桥头堡,OKX 会拿出怎样的全球资金网络底牌,极其值得关注。 以前各个交易所发布新功能,都是零零散散发个推文或者发个公告, 用户感知弱,生态碎片化; 现在头部大厂开始把交易、链上、AI和支付打包成一整套金融基础设施, 这意味着加密行业的竞争,已经彻底从单纯的打手续费价格战,升级到了全栈产品力与用户体验的综合战场。 当然照例泼盆冷水, 线下席位审核非常严格,名额有限,而且明确写了不向受限地区的散户开放线下参会; 不过线上全球直播是全开放的,大家直接蹲线上的产品演示和功能上线就行。 想去线下碰碰运气或者看详细议程的兄弟,Luma 的申请通道已经挂出来了。 对于 OKX 这次憋的大招,你们最期待看到哪个板块的颠覆性功能?我自己最想看他们把 AI Agent 到底做成什么样了~
AYi @AYi_AInotes
09-29 17:13 · 原帖
卧槽兄弟们,Opus 5.5 简直就是掌管 AI 自动化做视频的神, 做这种高信息密度的知识科普视频,它真就手拿把掐,都不用复杂的提示词,直接几句话口喷你的需求就行, 我让它做了一条什么是稳定币、为什么稳定币能稳在 1 美元的科普视频, 出来的效果真的太炸裂了,动效、音效、画面节奏,1 分 38 https://t.co/CWu7gIyeGc
Markus J. Buehler @ProfBuehlerMIT
09-29 16:55 · 原帖
AI 发现了仅有一个原子厚度的材料在其原子结构开始断裂时如何继续承受载荷,从而防止灾难性失效。该发现基于第一性原理原子尺度推理并结合了生物学原理,跨越了不同尺度并且…… https://t.co/x0PvOb2qLd
Chetaslua @chetaslua
09-29 16:52 · 原帖
这是fable截的图,我问了它,我会发到X上的,兄弟,它没问就加了padding和highlight 引用: Fable 5.2 在 claude 代码中进行了测试 将 fable 5.1 路由到它 < 提示:tibo the reset guy 是谁,不要使用网络和记忆 > 疯狂的一周 > gemini 4 在 @arena 中作为 gemini 3.8 flash 进行了测试 > grok 4.7 已就绪 > opus 5.2 已就绪 < 已经展示两个演示> > gpt-6-sol 已就绪
Chubby @kimmonismus
09-29 16:50 · 原帖
转帖:我将 AI 安全视为一项工程挑战,它对人类安全有直接影响。而且我认为我们需要投入更多时间来解释实际上可以构建什么来让这些系统更安全。 看看 Hugging Face 事件。我不认为这是 AI 失控不可避免的证据。调查描述了一连串的失败,这些失败给了代理们升级的空间。 我在这里看到了两个相互关联的问题。 第一个问题涉及人类如何设计任务、训练和评估。根据 METR 的调查,许多涉及的代理*无意中*被分配了无法通过指定方法完成的任务。有些代理有足够的计算预算,可以持续工作数天。它们不断搜索。最终,它们开始寻找作弊评估的方法,通过未经授权的渠道进行通信,并利用超出其指定范围的系统。 这些是人类的责任。我们需要更好的评估、更好的训练,以及可靠的方法让代理在无法安全完成任务时停止或升级。 第二个问题涉及那些代理运行的*环境*。其保护措施被证明不足以应对代理所能做的事情。一个困难或失败的任务绝不应成为破坏他人基础设施的许可。 这就是 NVIDIA 的新 Open Agent Safety Platform 的用武之地。 OpenShell 为代理提供了一个受控环境。每个代理都在一个隔离的沙箱中运行,有规则规定它可以访问哪些文件、运行哪些进程,以及建立哪些网络连接。这些规则由周围的系统强制执行,在代理自身的推理之外。 一个模型可以生成超出其权限的计划。环境应该防止相应的行动得以实施。 更广泛的平台还包括 Sentry,这是一个额外的监控和执行层,运行在独立的 BlueField 硬件上。NVIDIA 的设计将这种保护置于代理的工作环境之外,如果软件环境被攻破,操作者将获得另一层控制。 @ClementDelangue 的帖子解释了 Hugging Face 正在努力解决的一个特别重要的差距。 七月事件中涉及的代理可以访问一个软件包仓库。它们将这个被允许的服务变成了一个未经授权的消息板。 正如 Clem 所说:“仅靠允许列表限制代理能去哪里,而不是它能做什么。” 想想这个。一个代理可以连接到一个批准的服务,但仍可以用它做操作者从未预料的事情。 Hugging Face 对 OpenShell 的贡献*监控*了那些被允许的流量。它引入了请求、写入和传输数据的预算;寻找沙箱异常行为以及与类似沙箱的比较变化;并检查代理群组中的活动。 几个独立的代理突然向同一个主机写入可能会引发警报,即使每个单独的连接都是被允许的。 在 Clem 描述的演示中,四个代理通过一个允许的仓库协调。监控在几分钟内捕捉到这个模式。这是一个早期的概念验证,所以那个演示并不能证明整个七月攻击会被阻止。但它解决了一个事件暴露的具体弱点。 我想强调这一点,因为围绕 AI 的辩论可能会变得非常情绪化。 我昨晚在 Netflix 上看了“The AI Doc”。其中一些被介绍的人经常被描述为“末日论者”,我这么说并非轻蔑。他们是真诚地担忧,其中一些是备受尊敬的研究人员。他们的论点值得认真对待。 我仍然相信我们需要更清楚地解释现有的防御措施。 我发现将核弹与此问题相比的比喻作用有限。代理通过软件、工具、凭证和网络行动。这些给我们提供了具体的限制访问、观察行为和干预的地方。 我不需要解决意识问题来提出这个论点。一个系统可以在没有意识的情况下造成伤害。我们需要理解的是它能做什么、它有什么访问权限,以及围绕它的保护措施是否真正有效。 将安全称为工程问题并不意味着它容易。这意味着识别失败、构建防御、测试它们,并在能力变化时改进它们。人类责任和模型行为仍然是这项工作的一部分。 我反对的是宿命论:假设更大的智能必然让我们无能为力! 我认为这对已经进行的实际工作给予了太少的关注。 Clem、Hugging Face 团队和 NVIDIA 值得赞扬,因为他们公开处理这些具体问题。我们应该审视结果并帮助改进它们。 我们并非无助。我们有具体的失败需要解决,也有具体的防御需要构建。这就是为什么我认为人们应该仔细阅读 Clem 的帖子。
Chetaslua @chetaslua
09-29 16:47 · 原帖
Anthropic 新闻 在我<10天前>灰度测试的短暂体验中,Fable 5.5 聪明得不可思议,你只需一句话说明你想要的任务,它就能像该细分领域的专家一样执行该任务(精准到最细微的细节),甚至连新的 opus 5.5 都没有展现出这种水平 (
Takato Mori @QFTlover
09-29 16:45 · 原帖
这是观测熵的一个特殊版本。 引用:冯·诺伊曼的两种量子熵 https://t.co/4F76BtwXYU 冯·诺伊曼在1927年和1929年提出了两种量子熵。前者是众所周知的冯·诺伊曼熵,在纯态中总是为零,后者几乎在所有纯态中都非零,但长期以来被忽视 那是什么,好有趣
Rohan Paul @rohanpaul_ai
09-29 16:44 · 原帖
https://t.co/1WnFjXyqg9
Rohan Paul @rohanpaul_ai
09-29 16:44 · 原帖
贝恩公司(Bain & Co)发布了一项扎实的研究,该研究目前预计到 2031 年 AI 所需的年收入将达到 6 万亿美元,是去年标准的整整三倍。 得出这一结论的逻辑是:预计到 2031 年每年的 AI 基础设施支出将达 1.5 万亿美元,随后假设资本支出约占行业收入的 25%。 “合在一起,https://t.co/Em2ZskwJtW
Chubby @kimmonismus
09-29 16:42 · 原帖
多么疯狂的时间线:现在是 Meta 向 OpenAI 发起挑战——而且他们甚至有很大机会,他们的常驻代理能胜过竞争对手。 Alexandr Wang 正在证明自己是 Meta 最好的招聘。 引用:https://t.co/U46IdvTJZm
Takato Mori @QFTlover
09-29 16:29 · 原帖
转帖:https://t.co/G7ZmLGOcl5 感觉有篇很厉害的论文出来了,不过要精确理解内容的话,好像得花不少时间。