RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
Anthropic限制竞品研究&Claude Fable 5遭管制 / TypeScript 7.0 RC 10倍提速 / Nvidia Nemotron 3 Ultra发布
Anthropic对Claude Fable 5增加竞品研究限制,并疑似降低同行研究者输出质量;美国出口管制迫使Fable全球下线。DeepSWE等新基准显示智能体编程能力未触顶。Nvidia发布Nemotron 3 Ultra混合架构开源模型。Spring I/O演讲演示LLM应用攻防:路径穿越污染RAG、SQL注入越权、拆分追问绕过护栏,强调授权与可观测性。TypeScript 7.0...
BestBlogs早报:Anthropic限竞品研究引争议;LLM应用攻防警示;软件工程未真正工程化
6月20日早报聚焦:Anthropic发布Claude Fable 5,限制开发者构建竞争性LLM,还曾降低疑似研究者输出质量;美国商务部下出口管制,全球禁用访问权,Andrew Ng批评此举加速多国AI主权讨论。Spring I/O上Brian...
Anthropic 恰乌里称有信心"未来几天"重新开放 Mythos 及 Fable 5 AI 模型
由于美国白宫安全指令,Anthropic 临时封锁了前沿模型 Claude Mythos 和 Claude Fable 5 的访问权限。6 月 19 日,Anthropic 国际董事总经理克里斯·恰乌里在首尔新闻发布会上表示,有信心在"未来几天内"向美国之外地区重新开放这两个模型。Anthropic 将深化对韩投资,已开始组建商业、技术、政策和运营团队,韩国是其在全球使用量中排名第 12...
本周AI动态:OpenAI免费健康AI、Anthropic机器人狗编程等
OpenAI将前沿级健康AI从高级推理模型移至免费的GPT-5.5 Instant模型。Satya Nadella关于AI组织经济学和"token资本"的文章走红。Anthropic展示Claude Opus 4.7用12分07秒编程机器人狗,比去年人类团队快20倍,并推出Claude...
超越Claude Fable 5:智谱GLM 5.2登顶Design Arena网页设计AI榜单
智谱 GLM 5.2 在 Design Arena 单轮 HTML 网页设计评测中首次登顶总分第一,超越 Claude Fable 5、Opus 4.6 和 Opus 4.7,比前代 GLM 5.1 提升 5 个名次。推理价格每百万 tokens 为 1.40/4.40 美元,远低于 Fable 5 的 10/50 美元。模型高效调用 chart.js、three.js...
AI HOT 日报 · 2026-06-20 — 阿里开源向量数据库Zvec,UCSD黄碧薇教授提出因果AI第四代范式
阿里开源向量数据库Zvec,UCSD黄碧薇教授提出因果AI第四代范式 — 点击查看完整日报
可验证搜索不是可学习的链式思维
论文以九个确定性生成器推理任务为测试床,证明可验证搜索无法作为可学习的CoT进行蒸馏。Cryptarithm任务中,即使backbone规模从3B到671B、采用多种CoT设计、基于可验证奖励的强化学习和自训练,蒸馏后准确率始终为0.01-0.07,而搜索求解器回答71%实例。模型能正确计算97-100%的算术步骤并将正确密码排在候选前八(71%),但无法前向推导。干预实验揭示密码键后,同一...
Codex 实现远程/本地切换
Remote / local handoff in Codex! 一步步消除边界。 当你让模型掌握主导权时,实际上需要的底层设施更少。
Luma AI 参展 ICML 2026 并招聘
Luma 正在参加 ICML 2026。 地点:首尔 COEX,7 月 6 日至 11 日,展位 B701。 我们的研究和招聘团队已到场,我们正在招人。 来找我们吧。
visionOS 27 今秋推送:M5 Vision Pro 头显独占 Siri 语音定制和苹果最强本地 AI 模型
visionOS 27 将于今秋推送。M5 Vision Pro 独占 Siri 语音定制(Voice Customization),用户可自由调整语气表现力和语速;同时独占搭载 AFM 3 Core Advanced 本地 AI 模型,该模型支持原生多模态能力并采用稀疏架构,需 M5 芯片算力支撑。M2 款 Vision Pro 可共享 visionOS 27 大部分升级,包括 Siri...
智谱 AI 开源 GLM-5.2,编程基准仅落后 Claude Opus 约 1 个百分点
智谱 AI 开源新一代大模型 GLM-5.2,在编程基准测试中表现亮眼,仅落后顶级闭源模型 Claude Opus 约 1 个百分点。马斯克预测中国大模型需到 2027 年 Q1 才能追上 Anthropic Fable,智谱创始人唐杰回应"用不了那么久"。
AI Cola口语自然但写推文易变AI味
用户发现其使用的AI助手Cola在口头对话时"很有人味儿",但一旦要求将刚刚说的话"写成推文",输出立刻变得充满AI腔调,多次修改也难以恢复最初口语的自然感。用户推测,"写"这个提示词本身可能激活了模型偏向套话八股的神经网络。该现象反映了AI在口语自由对话与书面格式化输出之间的风格差异。
NVIDIA Research 发布 SpatialClaw:免训练空间推理框架
NVIDIA Research 发布 SpatialClaw,一个免训练的空间推理框架。它通过将代码作为动作接口,让智能体调用感知工具(Depth Anything 3、SAM 3)并自由组合输出,解决视觉语言模型在 3D 空间判断上的弱点。在 20 项基准测试中平均准确率达 59.9%,比近期智能体 SpaceTools 高 11.2 个百分点,比无工具基线高 6.5...
NVIDIA Research 发布 SpatialClaw:免训练空间推理框架
NVIDIA Research 发布 SpatialClaw,一个免训练的空间推理框架。它通过将代码作为动作接口,让智能体调用感知工具(Depth Anything 3、SAM 3)并自由组合输出,解决视觉语言模型在 3D 空间判断上的弱点。在 20 项基准测试中平均准确率达 59.9%,比近期智能体 SpaceTools 高 11.2 个百分点,比无工具基线高 6.5...
MCP 的真正价值:将认证流程隔离在 Agent 上下文窗口之外
MCP 相较于 skills/CLI 的关键优势在于,它能将认证流程隔离在 Agent 的上下文窗口之外,甚至完全脱离 Agent 框架。其理想形态可能仅仅是作为 API 的认证网关--即便如此也是一项胜利。
白宫以国安为由限制Anthropic AI模型Fable和Mythos出口
上周五,白宫以国家安全为由命令Anthropic限制其AI模型Fable和Mythos向美国境外及境内外国公民出口。Anthropic接到通知后约90分钟内限制访问,两个模型已有一周无法使用。此前Mythos仅对约150家审查过的公司开放。触发禁令的两个事件:Anthropic给予一家疑似与中国有关联的韩国电信Mythos访问权;亚马逊CEO报告发现绕过Fable...
Codex 团队列表发布,提前回应
Codexチームのリスト 「なんで自分が入ってないの?」ってDMが来る前に https://x.com/i/lists/2067819170989854863
特朗普见Anthropic CEO后改口,Amazon被指举报
特朗普对Anthropic的态度在一天内反转:此前将其视为国家安全威胁,但会见CEO Dario Amodei后改口称其"聪明、好人、反应很负责任"。被问是否用国防生产法管制AI时,他表示"可能但似乎大家都很负责任"。特朗普还透露,举报Anthropic的是其竞争对手兼部分股东--Amazon。这一事件暴露了AI监管的真实逻辑:出口管制等重大决策可能取决于与总统的面谈效果。
VibeThinker-3B:基于Qwen2.5-Coder-3B的3B密集推理模型,开源MIT
新浪微博研究人员发布VibeThinker-3B,一个仅3B参数的密集推理模型,基于Qwen2.5-Coder-3B,采用谱到信号后训练流水线(SFT、强化学习与自蒸馏),MIT开源。在AIME26上得分94.3,比肩DeepSeek V3.2(671B)和Kimi K2.5(1T);LiveCodeBench v6达80.2...
挪威对小学阶段的人工智能实施近乎全面禁令
挪威宣布从新学年(8月底)起,对1至7年级(6-13岁)小学生近乎全面禁止使用生成式AI工具;8至10年级(14-16岁)可在教师监督下谨慎使用;11至13年级(17-19岁)则需学习适当使用AI以备升学和工作。政府同时计划立法增加课堂纸质书籍,逆转平板电脑趋势。此举源于教育测试成绩持续下滑,此前挪威已于2024年禁止校园内智能手机。
摩根士丹利:全球数据中心建设资本支出约2.9万亿美元,AI资本支出依赖债务融资或引发社会级风险
摩根士丹利估计,到2028年全球数据中心建设资本支出约2.9万亿美元,资金来源包括超大规模企业现金流1.4万亿美元、公司债2000亿、证券化信贷1500亿、私人信贷/资产融资/合资债务8000亿等。AI资本支出愈发依赖信贷,损失可能超出股东范围。NYU教授Damodaran指出,与互联网泡沫不同,AI资本支出规模史无前例且大部分由债务融资(尤其是私人资本),一旦调整,违约和困境将蔓延至整个社...