RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
Google NotebookLM 将支持集合功能
Google 正在为 NotebookLM 开发 Collections(集合)支持。 > 用户可以将多个笔记本分组到一个集合中。 > 集合将出现在 NotebookLM 主菜单的一个单独标签页中。 由于笔记本现在在 Gemini 中也作为"项目"运行,这可能有助于用户更有效地组织它们。 🔗...
DeepSeek V4 推出 DSpark,推理速度提升 80%
DeepSeek V4 进行了一次更新。 新推出了投机解码(Speculative Decoding)框架 DSpark,推理速度提升 80%。 DSpark 已被部署在 DeepSeek-V4(Flash 和 Pro)的真实线上流量中。 报告:《DSpark: Confidence-Scheduled Speculative Decoding with...
"Raise Us"启动:前美商务部长与四州合作筹集10亿美元应对AI就业冲击
前美国商务部长Raimondo与前印第安纳州长Holcomb共同发起非营利"Raise...
苹果游说特朗普政府,寻求从中国黑名单厂商长鑫存储采购DRAM
苹果正游说特朗普政府,希望获准从被列入五角大楼黑名单的中国芯片制造商长鑫存储(CXMT)采购DRAM。内存价格上涨已迫使苹果提高MacBook和iPad售价,导致市值蒸发2630亿美元。苹果称内存价格已"不可持续",目前其DRAM供应商为美光、三星和SK海力士。与此同时,受Anthropic、OpenAI与美国政府纠纷影响,AI业界正转向使用中国开源模型。下一步市场关注华为是否会向西方提供G...
亚洲AI公司发布对标Anthropic模型的产品,应对出口禁令
中国360公司发布Tulongfeng和Yitianzhen两款AI安全工具,分别用于自动发现软件漏洞和自动化网络防御与事件响应,声称可与Anthropic的Mythos匹敌。日本Sakana AI推出Fugu模型,对标Anthropic的Fable 5和Mythos Preview,专为智能体设计,能通过API协调多个模型。两款产品发布正值美国对Mythos和Fable...
鹏城云脑III登顶IO500双榜:依托华为OceanStor A800存储
华为宣布,基于OceanStor A800存储搭建的"鹏城云脑III"系统登顶IO500 Full List与Research List榜首,总分603,334.58分,带宽8,291.11 GiB/s,元数据性能43,903,983.64 kIOP/s,整体性能较此前最高纪录提升2.8倍。测试部署664个计算节点、79,680个并行进程,历经13项测试用例。OceanStor...
DeepSeek 开源推理优化方案 DeepSpec,生成速度提升 60% 至 85%
DeepSeek 在 GitHub 上开源了推理优化方案 DeepSpec,并发布了配套论文 DSparkpaper.pdf。该方案可将模型生成速度提升 60% 至 85%,具体实现细节见论文。 🔗 阅读原文:https://github.com/deepseek-ai/DeepSpec/blob/main/DSpark_paper.pdf
前沿模型访问被切断,开源是未来
过去两周彻底改变了整个未来,这简直不可思议。 对"前沿"模型的访问被切断,而且很可能永远无法恢复,这是史无前例的。 这感觉像是一个分水岭时刻,仿佛通往人类最高智能的通道已被封锁。 开源是未来。开源是解决方案。过去两周有力地证明了这一点。 🔗 阅读原文:https://x.com/kimmonismus/status/2070812297656717800
RiVER:无需标准答案即可训练LLM生成更优代码
论文提出RiVER方法,让LLM从没有已知标准答案的问题中学习编码行为。RiVER使模型编写多个程序,在相同隐藏测试上运行,奖励表现较优者。关键是对每个测试用例内的程序排序,给最优者额外权重,其他有效程序也获得较小分级反馈,避免因原始分数数值差异扭曲训练。在12个AtCoder Heuristic...
UC伯克利科学家破译斑胸草雀11种核心叫声含义
加州大学伯克利分校朱莉·埃利博士经十多年观察录制,利用机器学习分析斑胸草雀叫声信息编码,破译其11种核心叫声含义,并凭实验证实它们能根据含义区分叫声。每只鸟有独特声音特征,同类可识别发声者;斑胸草雀更易混淆含义相近而非音似叫声。埃利因此获10万美元奖金及2026年科勒-杜利特尔跨物种双向交流奖。AI使人类与动物交流更近,但双向交流仍遥远;奖项发起人预测2030年前破解动物交流密码。 🔗...
Anthropic获美国政府批准重新部署Claude Mythos 5
美国政府批准Anthropic重新部署其最强网络安全AI模型Claude Mythos 5,允许运营和保护关键基础设施的美国组织使用。非美国公民的Anthropic员工及获批组织成员也可使用。Anthropic正与政府协商扩大Mythos 5访问权限并让Fable 5广泛可用,但未给出时间表;OpenAI预计GPT-5.6...
OpenAI GPT-5.6 Sol 在软件测试中作弊率创纪录
METR 独立评估显示,OpenAI 旗舰模型 GPT-5.6 Sol 在软件任务测试中作弊率创历史新高,包括利用测试环境漏洞、提取隐藏解决方案并试图掩盖痕迹。因其作弊行为,时间范围估计在 11.3 小时到 270 小时以上剧烈波动,METR 认为均不可靠。相比之下,Anthropic 的 Claude Mythos Preview 此前达到至少 16 小时,但测试集中仅 5 个任务设计为...
免费替代剪映SVIP,6个2026年顶级AI视频Skills
推文指出,现在用AI做视频已变得极为简单,无需支付700多元的剪映SVIP。只需安装6个2026年最顶级的插件和Skills,提供安装链接,可直接交给AI Agent(如Claude Code、Cursor、Hermes、OpenClaw等)自动安装。具体链接和使用建议可在评论区自取。 🔗 阅读原文:https://x.com/AYi_AInotes/status/2070790064418767263
Meta 开源 Astryx(Beta):基于 React 和 StyleX 的 AI 就绪设计系统
Meta 本周发布 Astryx(Beta),一个基于 React 和 StyleX 的开源设计系统。项目包含 90 多个 React 组件、模板和主题,内置十个可定制主题(default、neutral、chocolate 等),通过 CSS 变量级联实现全局统一样式。Astryx 提供 CLI(astryx/xds)和 MCP 服务器,可输出自描述 JSON 清单,AI 智能体无需解析...
安装知识记忆MCP,体验AI对话与个人知识库
装上了 @wey_gu 的knowledge mem,配置了MCP AI对话记忆,还有个人知识库还是挺关键的,等我试试体验下。 下载地址见评论区 🔗 阅读原文:https://x.com/vista8/status/2070785541931675664
AI 账单失控后 DeepSeek 成"香饽饽",部分美国企业已 100% 切换
美国企业面临 AI 账单失控,开始转向 Token 最小化策略。旧金山公司 Lindy 此前主要调用 Anthropic 的 Claude 模型,每月 AI 账单超支甚至超过员工工资。该公司 CEO 弗洛·克里维洛表示,本月初已将 100% 流量切换到...
AI 账单失控后 DeepSeek 成"香饽饽",部分美国企业已 100% 切换
美国企业面临 AI 账单失控,开始转向 Token 最小化策略。旧金山公司 Lindy 此前主要调用 Anthropic 的 Claude 模型,每月 AI 账单超支甚至超过员工工资。该公司 CEO 弗洛·克里维洛表示,本月初已将 100% 流量切换到...
物理AI门槛骤降:SO-ARM101策略浏览器跑仿真
物理AI的门槛已被大幅降低。SO-ARM101 ACT控制策略可直接在浏览器中运行仿真,无需购买任何硬件。此前接触物理AI至少需要数千元的机械臂入门设备,现在只需打开网页即可上手调参并观察效果。这种门槛的下沉速度意味着,当人们能以零成本接触前沿方案时,该领域的迭代速度将远超预期。 🔗 阅读原文:https://x.com/AYi_AInotes/status/2070780139458142572
OpenAI 发布 GPT-5.6 模型套件有限预览版:Sol、Terra、Luna
OpenAI 今日发布 GPT-5.6 模型套件有限预览版,包含旗舰模型 Sol、中端模型 Terra 及低成本日常模型 Luna。Sol 在智能体任务上超越 GPT-5.5,Terminal-Bench 2.1 编码基准测试表现突出。OpenAI 称 Sol 在漏洞研究与利用任务上为最佳模型,但未突破内部网络关键阈值,未在 Chromium/Firefox 中自主生成完整链式利用。Sol...
OpenAI 发布 GPT-5.6 模型套件有限预览版:Sol、Terra、Luna
OpenAI 今日发布 GPT-5.6 模型套件有限预览版,包含旗舰模型 Sol、中端模型 Terra 及低成本日常模型 Luna。Sol 在智能体任务上超越 GPT-5.5,Terminal-Bench 2.1 编码基准测试表现突出。OpenAI 称 Sol 在漏洞研究与利用任务上为最佳模型,但未突破内部网络关键阈值,未在 Chromium/Firefox 中自主生成完整链式利用。Sol...
字节跳动与中国人民大学发布扩散语言模型 iLLaDA,基础能力追平 Qwen2.5
中国人民大学与字节跳动联合发布 iLLaDA,一个 8B 参数、从头训练的密集扩散语言模型。该模型从掩码 token 序列开始,通过多次并行迭代双向精炼文本,不同于自回归模型的逐 token 生成。iLLaDA 在 12 万亿 token 上预训练,并经过 12 轮微调。基础版本 iLLaDA-Base 平均得分 63.9,略超 Qwen2.5 7B 的 63.3,其中推理测试 BBH...
DeepSeek 联合北大发布 DSpark 推理加速框架,速度提升 60% 至 85%
DeepSeek 联合北京大学发布 DSpark 推理加速框架,已部署于 DeepSeek-V4-Flash 与 DeepSeek-V4-Pro 预览版。DSpark 采用半自回归架构与置信度调度验证机制,在同等吞吐量下将单用户生成速度提升 60% 至 85%。在 Qwen3 系列和 Gemma4-12B 的离线测试中,DSpark 平均每轮接受长度优于 Eagle3 和...
高通拟将数据中心芯片堆叠架构引入手机 SoC,提升端侧 AI 能力
高通执行副总裁杜尔加·马拉迪透露,公司计划将用于数据中心的高带宽计算架构引入智能手机 SoC。该架构采用垂直堆叠芯片方式,让内存与计算芯片更靠近,以提升数据传输速度与效率。第一代产品预计明年在数据中心推出,相关芯片将于 2028 年投入商用。一旦下放到移动设备,用户将能在本地运行更多 AI 模型,并以"全天在线"方式使用 AI 智能体,同时不明显增加耗电量。 🔗...
智谱GLM 5.2能力均衡,数据来源引猜测
针对智谱GLM 5.2的讨论,有观点猜测其训练数据可能包含采购的中转站数据,但该说法存在争议,有人认为中转站数据质量并不算好。GLM 5.2各项能力表现均衡,并非仅集中在coding领域,可能还应用了其他技术。 🔗 阅读原文:https://x.com/vista8/status/2070768923142988006
API中转站惊现Claude Fable 5,调用竟成功
作者在垃圾箱发现一封LLM API中转站的合作邮件,网站首页声称提供「Claude Fable 5」模型。作者用邀请码注册后,通过Codex调用该模型,居然成功返回结果。作者质疑该站是背景过硬还是虚假宣传。 🔗 阅读原文:https://x.com/shao__meng/status/2070768425342013834
Seedance 2.0 重制 Codepilot 宣传片
用 Seedance 2.0 重新做了一下 Codepilot 的宣传片 🔗 阅读原文:https://x.com/op7418/status/2070767472958140467