我的 X 阅读

我的关注 科学物理人工智能 神奇小子 动物世界

科学物理人工智能 · 3000 / 3000 条

已同步 74 个列表成员 · 当前内容涉及 65 位作者

更新 10-11 10:37

重置

3000 条 · 第 148/200 页 · 刷新

BURKOV @burkov
10-02 10:14 · 原帖
转帖:百页语言模型书籍——使用 PyTorch 动手实践:https://t.co/SiVg4ajUKn by @burkov
BURKOV @burkov
10-02 10:13 · 原帖
转帖:百页机器学习书籍(百页书籍系列) 链接 - https://t.co/D5qFZaBd3P #MachineLearning #ML #AI #DeepLearning #Python #DataScience #programming
BURKOV @burkov
10-02 10:13 · 原帖
转帖:安德烈·布尔科夫 (Andriy Burkov) 的《百页机器学习手册》(PDF + EPUB + 其他 PDF 格式)正在 Leanpub 上促销!建议零售价 40 美元;使用此优惠券可享 14 美元优惠价:https://t.co/dnjPx4tqfM @burkov #data_science #computer_science https://t.co/AXGrnJu6YM
Beff (e/acc) @beffjezos
10-02 10:12 · 原帖
/acc 引用:https://t.co/UsqDdNQEBI
Rohan Paul @rohanpaul_ai
10-02 10:12 · 原帖
转帖:一个 9B 模型在生物医学提取任务上击败前沿旗舰模型 4 倍的性能,这可不得了。 @OvermindLab 推出了一款平台,可以将公司的代理数据转化为公司拥有的小型专业模型。 它记录代理在生产环境中的行为,将这些记录转化为训练数据,然后微调并部署一个开源权重的模型。 客户可以下载权重、重新训练或回滚,而平台代码采用 AGPL-3.0 开源。 查看下面的图表以了解其性能数据。例如,在一个案例中,针对超过 100 份合同的超过 4K 个问题,Overmind 微调的 9B 模型在查找正确条款时的 F1 分数达到 91.6%,而 GPT-5.6 Luna 仅为 82.0%。
Beff (e/acc) @beffjezos
10-02 10:10 · 原帖
这真是很酷的技术,将是把一大堆芯片扩展成光子织构的关键 首款同类光子主板 很兴奋能作为早期天使投资人参与,并一直关注 Tap 的精彩历程 引用:激动地宣布 Volantis 完成 8800 万美元 A 轮融资。 我们通过使用光学技术解决 AI 的内存瓶颈,从而实现芯片拥有海量快速且廉价的内存。 通过将每芯片的内存带宽和容量提升数个数量级,我们实现了超快速推理(高达 10,000 tps/用户)用于大型模型(>10T)——而且每令牌成本低廉。 最初,这将实现疯狂快速的智能代理——想象一下,编码代理能在几分钟甚至几秒钟内完成任务,而不是数小时。 更令人兴奋的是,光学是一种从根本上可扩展的方式来增强内存系统。不是每年 2 倍增长,而是跨新世代提升数个数量级。这将催生一个结构全新的 AI 产业,包括重启缩放定律、在上下文窗口中容纳整个代码库等更多可能性。 我们的团队率先开发了许多核心半导体技术:首款 CoWoS 产品、早期 HBM、首款硅光子 CPO 系统、首款高产量可调谐 VCSEL、首款使用光直接通信的处理器等。 我们已经将数据传输距离发送得比芯片封装内同样微小的电线远超过 10 倍。我们的下一代迭代已完成流片,目标是在相关距离上实现世界纪录带宽密度,阅读更多:
Liquid AI @liquidai
10-02 10:03 · 原帖
转帖:非常骄傲能在我最喜欢的平台上提供我们的模型服务!
小互 @xiaohu
10-02 10:00 · 原帖
OpenAI 前一天发布会上 dots 的现场演示翻车了(他们甩锅说是是 WiFi 问题) 于是他们换了个网好的地方不剪辑重录一遍演示 演示者给自己的 dot 打了一通电话,口头交代了三件事: 1. 订差旅:明天临时去洛杉矶,下午 3 点要到好莱坞开会。让 Dot https://t.co/y3Pg29WqoG
Rohan Paul @rohanpaul_ai
10-02 09:57 · 原帖
转帖:每个技术时代都会创造出之前从未存在过的职位。这一时代的重要职位就是自动化工程师。 @getserval 的一个设计选择解释了为什么自动化工程师这个角色存在。 管理员用通俗语言描述一个流程,Serval 将其转化为基于代码的工作流程,然后进行审查、测试和批准。帮助台代理只能通过这些已批准的工作流程来行动。其他任何事情都会转交给人工处理。 对于每个客户,@getserval 的自动化工程师都会在与 IT、人力资源、财务和法律团队嵌入合作的同时,直接将 AI 代理构建到该客户的 Serval 设置中。
小互 @xiaohu
10-02 09:53 · 原帖
卧槽 不得不佩服马斯克的脑洞 SpaceX 正在推出一个新的@Starlink For Communities 计划,你可以通过通过向邻居或附近的人提供 Starlink 互联网服务来赚取收入... 他们可以按小时、天、周或月付费访问你的网络 引用:Big news! SpaceX is introducing a new @Starlink for Communities program that lets you earn money by providing Starlink internet to your neighbors or people nearby, who can pay for access by the hour, day, week, or month. Neighbors pay for the access they need, while the person hosting the Starlink will earn money from every connection. One Starlink Kit can provide high-speed internet to multiple nearby users. Starlink handles payments, user access, and connectivity. Property owners, businesses, local entrepreneurs, etc, simply set up a Starlink Kit where there’s demand and can expand coverage with additional routers or kits. How to get started: • Step 1: Order the Starlink Kit. Your Starlink Kit arrives ready for shared use. Choose a location with multiple homes or users nearby. • Step 2: Place the kit where demand is highest. Starlink gives you clear instructions. • Step 3: Earn income each month Community members connect using flexible hour, day, week, or month passes. You earn from every connection. Anyone who sees an opportunity to bring connectivity to the people around them can participate. Apply here: https://t.co/Q0qvaNJmnK
小互 @xiaohu
10-02 09:49 · 原帖
Fable 5.5 要来了 看起来更强大 引用:Welcome To the era of Super intelligence : Fable 5.5 behold superman in continuous animation in different art style https://t.co/ZUS7o6DqWT
Rohan Paul @rohanpaul_ai
10-02 09:41 · 原帖
转帖:标准代理测试假设正确答案永不改变,但在实时数据上它确实会改变。 所以这篇 Adobe 论文使用重新计算它的代码进行检查,从而获得更准确的分数。 Adobe 的解决方案是将正确答案编写成代码,每次测试运行时获取当前结果。然后,AI 评分器会将代理的回复与它进行比较。 在 53 个测试用例中,AI 评分器通过这种方式比使用书面描述提高了 29% 的与人类专家匹配度,并使用了 16% 更少的令牌。如果没有答案可供检查,AI 评分器表现得比随机还差。 – arxiv. org/abs/2609.16487 标题:"Skill-based Agentic Evaluation for Real-time Data Science Tasks"
AYi @AYi_AInotes
10-02 09:40 · 原帖
转帖:为啥老特全球有那么多粉丝, 在中国都叫他老特,抛开政治立场, 我想很大一部分原因是他身上的活人感和真实不装,这个视频就非常有代表性,当马斯克道歉说我说错了的时候,这位美国总统开心的像个孩子, 特朗普:"埃隆,你缩后面干啥呢?我都没瞅见你。" 马斯克:"我想说说AI的正面意义——哦不对,嘴瓢了,是SI。" 特朗普:"行吧。" 拍了拍马斯克的手臂 https://t.co/eo60jt5Jmf
Yann LeCun @ylecun
10-02 09:40 · 原帖
转帖:销售就是回答客户心中的疑问。 宜家:这个适合我的客厅吗?放在那里看起来怎么样?眼镜:这些戴在我脸上看起来如何? 时尚行业从未做到过。直到现在。 Photoroom 的内部 iPhone 应用:这件衣服就穿在你身上。它随着你的动作而动。你能看到它的合身度、垂感,以及穿在身上的整体效果。 这就是为什么转化率会上升,退货率会下降。一见钟情的视觉效果。 @photoroom_ml 为每个品类回答这个问题。目前已在我们的 GPU 上运行。 这是我手机上的演示。恭喜 @AharonAzulay 和 @v_pradeilles !
Yann LeCun @ylecun
10-02 09:35 · 原帖
转帖:新散文:大帐篷还是小帐篷的AI安全运动? 支撑安全辩论的未明言的分歧 https://t.co/4T9n7BLTWX 关于AI安全的两种叙事已经浮现:要么AI存在风险真实且迫在眉睫,要么AI领导者和举报人的此类声明是不真诚的——一种“心理战”、炒作或扭曲的监管俘获形式。 很少有人考虑第三种可能性,即x风险警告是真诚的,但只是错误的,并且对AI安全起反作用。仿佛每个人都想当然地认为那些敲响警钟的人是天才,唯一的问题是他们是仁慈的天才还是邪恶的那种天才。 我们不认同任何一种叙事。在我们关于AI安全的写作中,@sayashk 和我一直努力认真对待这些论点,但反驳我们认为不合理的诸多声明,同时突出我们认为真实的担忧。本文是这一议程的延续。 部分 - 我们确实系统性地在针对灾难性和系统性风险的韧性上投资不足 - 考克森事件展示了扭曲的媒体环境如何将x风险置于更务实的担忧之上 - 为什么x风险框架可能对AI安全政策起反作用 - 结论:大帐篷还是小帐篷的AI安全运动?