RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
Atomic Agent 成为首个在 GAIA 基准上超越 Hermes 的开源本地 AI 智能体
Atomic Agent 成为首个在 GAIA 基准上超越 Hermes 的开源本地 AI 智能体。使用 Qwen-3.6-35b-A3B 模型,在相同预算下解决 37/53 个任务(Hermes 为 31 个),且运行更快。其 TurboQuant 技术将 KV-cache 缩小 6.4 倍并提速 30-50%,使 9B 模型也能完成 52.8% 的任务。 🔗...
OpenAI 总裁布罗克曼承认 Kimi K3 竞争力强,但称仍有"巨大优势"
OpenAI 总裁格雷格·布罗克曼接受彭博社采访时承认,月之暗面发布的开放权重模型 Kimi K3"确实相当不错",但判断其是否通过蒸馏 OpenAI 模型来训练还为时过早。布罗克曼强调,OpenAI 在计算资源和 AI 研究上的多年积累使其仍保持"巨大优势",并指出开放权重模型并非免费,算力成本不低。 🔗 阅读原文:https://www.ithome.com/0/980/356.htm...
AI 算力需求爆发致高端 PCB 供不应求,价格暴涨超三倍
受AI算力需求爆发带动,高端PCB今年以来持续供不应求,部分价格涨幅已超过三到四倍。AI服务器所用PCB层数可达30层以上,高端产品达70至100层,单台AI服务器PCB价值量接近普通服务器的10倍。2026年全球AI服务器出货量预计突破200万台,同比增长55%,直接拉动高端PCB需求增长超110%,头部厂商订单已锁定到2027年。 🔗...
硅谷近200家公司呼吁保留中国开源AI模型
包括Proton和Y Combinator在内的近200家硅谷公司联合致信特朗普政府,要求不要切断对中国开源权重AI模型的访问。他们警告称,此举可能严重损害美国下一代初创企业的发展。 🔗 阅读原文:https://x.com/kimmonismus/status/2080067234232226106 via AI HOT ·...
AI 实验室是否故意训练模型画骑自行车的鹈鹕?系统性测试未发现证据
Dylan Castillo 对 7 款模型(GPT-5.6 Terra、Claude Sonnet 5 等)进行了 8 种动物 × 6 种交通工具共 48 个提示词的测试,每款模型运行 3 次。结果未发现任何实验室在绘制"鹈鹕骑自行车"方面表现更优,该组合场景也并非记忆生成。 🔗...
马斯克:Optimus 将是史上最大产品,量产难度极高
马斯克称,Optimus 人形机器人将成为史上最大产品,但实现无需编程、仅靠指令或视频即可执行任务的自主机器人是前所未有的难题。机器人需具备极高灵巧性、可靠性及耐用性,而特斯拉需从零建立供应链,所有部件均为全新设计,量产爬坡难度远超以往任何产品。 🔗 阅读原文:https://x.com/cb_doge/status/2080065417473905040 via AI HOT ·...
研究显示AI在MBA案例中表现优异且快速进步
一篇有趣的论文研究了AI如何解决多个领域内无边界、复杂的商业问题,通过测试它们破解商学院MBA教学案例的能力:1) AI已在多种商业主题上表现极为出色 2) 模型能力随时间快速提升 🔗 阅读原文:https://x.com/emollick/status/2080064607138283742 via AI HOT ·...
苹果 Apple Store 应用有望上线"虚拟购物助手"AI 导购
苹果新版 Apple Store 应用隐私政策披露,计划推出名为"虚拟购物助手"的 AI 导购助手。该助手将收集账户信息、设备标识符、聊天内容及位置数据,用于个性化回复与改进体验,部分聊天内容在清除个人标识后共享给合作伙伴。用户可在"账户 > 设置"中通过"聊天改进"开关控制数据是否用于模型训练。 🔗 阅读原文:https://www.ithome.com/0/980/351.htm...
马斯克:Grok 将担任 Optimus 的"经理"
ELON MUSK: Grok 将担任 Optimus 的经理。 Optimus 需要能够像人类一样走到电脑或触摸屏前并使用它。这需要具备理解实时视频、控制屏幕以及实时操作计算机的通用能力。这一能力正在与 SpaceXAI 的 Grok 合作开发。大型 Grok 模型将担任经理,为 Optimus 分配一系列任务并指示其行动。 🔗...
Cursor 发布 Cursor Router:请求级分类器,以 30-50% 更低成本实现前沿编码质量
Cursor 已面向 Teams 和 Enterprise 计划全面推出 Cursor Router。该系统根据查询、上下文、任务复杂度和领域对每个请求进行分类,并将其路由至最合适的模型。在线 A/B 测试显示可节省 60% 成本,三家早期接入企业客户相比 Opus 4.8 费率节省了 30-50%。 🔗...
AI圈自媒体生存法则:差异化与持续输出
姚金刚总结AI圈自媒体10条观点:每个人应做自媒体,最可靠的发声渠道是自己的账号;AI生成内容越强,差异化越重要,稀缺的是独特观点、真实经验和有密度的干货。对OPC而言,自媒体是成本最低、复利最明显的获客方式,自媒体的本质是长期占据生态位、持续被看见并建立信任。 🔗 阅读原文:https://x.com/oran_ge/status/2080057721462858228 via AI...
马斯克:Optimus 将首款实现通用任务人形机器人
马斯克称,Optimus 将是首款能执行通用任务的人形机器人,而非预编程或远程控制的演示品。它具备与人类相当甚至更高的手部灵巧度,旨在成为日常生活中的实用工具。 🔗 阅读原文:https://x.com/cb_doge/status/2080054255839486047 via AI HOT ·...
NVIDIA Vera Rubin NVL72 集群交付,72 GPU 合一
NVIDIA Vera Rubin NVL72 集群已交付,单机框集成 72 块 GPU 并协同工作。该集群汇聚全球工业链:荷兰 EUV 光刻机、台湾晶圆、韩国内存堆叠。IneffableLabs 已从 Google Cloud 和 NVIDIA 接收首批集群,AI 硬件代际跃迁加速。 🔗...
模型输出无IP先例,蒸馏攻击难成立
Nathan Lambert指出,目前没有法律先例认定模型输出为知识产权,这一概念本身也难以成立。前沿AI实验室没有义务向这些客户开放API,若想保护模型生成内容,可通过其他方式实现。此前美国财长贝森特曾警告,中国企业的隐蔽、大规模蒸馏攻击若越界构成IP盗窃,将面临制裁与实体清单。 🔗...
Gabriel 感叹计算机使用技能将失传
有点难过,计算机使用将成为我们孩子失传的艺术 本地搭建 Minecraft 服务器,一个提示词搞定。任何设置,一个提示词搞定。驱动、网络、下载,任何问题,永远一个提示词搞定。 🔗 阅读原文:https://x.com/gabriel1/status/2080052073991962657 via AI HOT ·...
马斯克Q2财报电话会议开场发言
突发:埃隆·马斯克在今天Q2财报电话会议上的完整开场发言。 🔗 阅读原文:https://x.com/cb_doge/status/2080051526891188345 via AI HOT · https://aihot.virxact.com/items/cmrwnh44q00m4robh0xv3zksz
Google 以云业务强劲增长回应巨额 AI 投入质疑
Google Cloud 营收同比增长 82% 至 248 亿美元,远超华尔街预期的 224.6 亿美元,主要由企业级 AI 解决方案和基础设施采用驱动。Alphabet 整体营收同比增长 24% 至 1198 亿美元,利润从去年同期的 281 亿美元跃升至 1121 亿美元。Gemini 月活跃用户达 9.5 亿,较 2025 年 Q4 的 7.5 亿增长 27%。 🔗...
梁文锋投资人会议语录:AGI路线图与持续学习
梁文锋在投资人会议上阐述 DeepSeek 的 AGI 路线图,认为当前阶段最重要的是 Coding Agent,而多模态、3D 生成等并非智能核心。他指出下一代模型必须具备持续学习能力,这是实现 AGI 的关键阶梯。DeepSeek 坚持低利润、开源与克制战略,认为中国 AI 的差距主要在资源而非人才,并预测国内模型公司最终将收敛至两三家。 🔗...
Grok Build 上线,可调用 Grok 4.5 构建 3D 场景
Elon Musk 宣布推出 Grok Build,用户可通过该工具在终端中调用 Grok 4.5 模型。开发者 Daniel Farinax 利用 Grok Build 安装了 Unity 免费 CLI,成功构建 3D 场景并导出视频,还在同一会话中创建了可玩的 macOS 岛屿探索游戏。Unity CLI 支持 MCP 模式且免费,无并发限制。 🔗...
增大模型规模与思考时间提升决策质量
增大模型规模以增加选项空间 增加模型思考时间以考虑更大范围的空间 更长的思考能做出更好的决策,因为它考虑了更多结果;更大的模型听起来不那么像垃圾,因为它们更不易坍缩 🔗 阅读原文:https://x.com/gabriel1/status/2080048935960535236 via AI HOT ·...
EdgeBench:AI智能体基准测试与缩放定律分析
EdgeBench 是一个评估 AI 智能体的基准,涵盖 51 个任务、多种运行时环境和交互时间预算。分析显示,Claude Opus 4.8、GPT-5.5、GPT-5.4、GLM-5.1 和 DS-V4-Pro 等模型在 2-12 分钟时间预算下性能差异显著,其中 Claude Opus 4.8 在多数类别中领先。 🔗...
Anthropic 推出经济指数连接器
Anthropic 推出新的 Anthropic Economic Index 连接器,允许 Claude 访问关于全球用户如何使用 Claude 的大型数据集。 > 探索关于世界如何使用 Claude 的公开数据。 🔗 阅读原文:https://x.com/testingcatalog/status/2080048592056725532 via AI HOT ·...
Genspark 推出首款硬件 SecondBrain Note 卡片式录音机
Genspark 发布首款硬件 SecondBrain Note,一款 2.95mm 厚、26g 重的铝制卡片式录音机,可独立录制 35 小时音频并拾取 5 米内人声。录音自动上传至 SecondBrain 进行转录和摘要,将对话转化为可搜索的会议记忆。产品售价 $179(首发 10% 折扣),已通过 SOC 2 Type II 和 ISO 27001 认证。 🔗...
知识蒸馏辩论应基于公开技术信息
夜晚我梦见一场基于公开技术信息的知识蒸馏辩论,而非揣测幕后交易与政治阴谋。 醒来后,我被混乱的现实、潜在的机密信息以及失控的全球AI生态压垮。 🔗 阅读原文:https://x.com/natolambert/status/2080047222146928696 via AI HOT · https://aihot.virxact.com/items/cmrwmcztj0099robhhtwu6ay3
首个本地Agent在GAIA基准上超越Hermes
首个本地AI智能体在GAIA Level 1基准上以37个任务超越Hermes的31个。该Agent通过llama.cpp运行Qwen、Gemma和Llama模型,采用stable-prefix缓存降低长会话成本,TurboQuant技术将KV缓存缩小6.4倍。项目已开源,支持macOS、Windows和Linux。 🔗...
Emad Mostaque 提及技能问题
技能问题 🔗 阅读原文:https://x.com/EMostaque/status/2080045811732283573 via AI HOT · https://aihot.virxact.com/items/cmrwmatzj006krobhtsfydjtt
ClawCast 第5期对话 OpenAI Codex 团队
The ClawCast 第5集已上线! @hrudolph 和 @Pat_Erichsen 与来自 @OpenAI Codex 团队的 @kevins8 一同参与。 在 Spotify 收听:https://open.spotify.com/episode/1nUIKmOZKrUVlXYjtvQdep 🔗...
Claude Code v2.1.218 发布
Claude Code v2.1.218 将 `/code-review` 改为后台子智能体运行,审查工作不再填满对话窗口。新增屏幕阅读器对删除文本的播报支持,并修复了 Windows 路径中 `\u` 前缀段被错误转为 CJK 字符导致文件无法访问、左箭头键误丢弃对话、多行粘贴合并为单行等多项 Bug。 🔗...
DAIR.AI 社区新界面由多模型协作构建
刚为我们的 @dair_ai 社区实现了一个新界面。 我先用 Fable 5 通过 HTML 构件(见附图)构思了一个概念设计。然后把它交给 GPT-5.6-Sol 来构建。 构件作为提示词效果很好。组合模型能带来效率提升。 🔗 阅读原文:https://x.com/omarsar0/status/2080039840200978917 via AI HOT ·...
Google Q2 资本支出创纪录,AI 基建投资激增
Google Q2 资本支出同比增长 100% 至创纪录的 449.2 亿美元,年化接近 1800 亿美元。其 Q2 营收增长 24% 至 1198 亿美元,Google Cloud 营收飙升 82% 至 248 亿美元,运营利润率近乎翻倍至 35.6%。Gemini 月活用户达 9.5 亿,模型 API 每分钟处理 220 亿 token。 🔗...