RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
家用机器人 Isaac 1 发布:可叠衣、收拾房间和整理床铺,满电续航 8 小时
美国机器人公司 Weave Robotics 推出家用机器人 Isaac 1,可完成洗衣折叠、收拾房间及整理床铺三类家务。机身搭载电动底座,伸缩臂可在 0.9 米到 1.75 米间调节。结合本地算法和远程控制,能自主折叠衬衫、短裤等简单衣物,折叠长裤等复杂衣物需人类通过摄像头远程操控。单次充电需 2 小时,满电运行 8 小时,提供 5 种颜色,售价 7999 美元,2026 年秋季发货。...
磐仪推出强固型边缘 AI 平台 FPC-9309W-G5,支持 RTX 5090 显卡
磐仪发布强固型边缘 AI 平台 FPC-9309W-G5,采用全金属防震机箱与工规级元件,支持 7×24 小时实时 AI 推理。内置英特尔 W880 芯片组主板,适配 35W/65W 酷睿 Ultra 200S 处理器,可安装 575W 的 RTX 5090 显卡。配备 3 条 PCIe ×4 插槽、2 个 M.2 M-Key PCIe ×4 SSD 盘位、2 个可拆卸 SATA...
Claude Code被曝加隐形水印 阿里巴巴内部禁用
Claude Code 被曝光针对中国时区和特定AI实验室用户,在 Prompt 中偷偷加入"隐形水印"。受此影响,阿里巴巴宣布内部全面禁止使用 Claude Code,办公环境下不得使用该工具进行工作和开发。 🔗 阅读原文:https://x.com/xiaohu/status/2072930686324154437
下一代智能体强化学习系统实现自我进化智能体
新论文提出自我进化智能体架构,解决企业智能体无法从日常杂乱交互中持续改进的问题。当前团队依赖人工检查、修改提示和重新部署,效率低下。论文提出三部分机制:1)以统一格式记录每一步交互;2)通过数据代理清洗、治理、存储并重放真实工作轨迹;3)控制层决定是否更新记忆、技能、提示、工具或模型权重。AREAL2.0展示了窄实现--将在线智能体的LLM调用路由至在线强化学习服务,用真实交互轨迹训练模型更...
《Fable》通关指南:短绳AI编程法
专业开发者经过一年多研究,总结出使用AI编码代理的"短绳方法"。该方法要求开发者全程参与:先规划并分解任务,从不使用YOLO模式,每次变更前审查差异并拒绝不想要的更改,每个子任务后提交以防止AI误操作(如Opus曾出现破坏性行为)。最终需进行人工与AI双重PR审查,PR须注明使用模型,提交者须亲自审查自己PR的代码。即便不用前沿模型,此法也能产出超越Fable 5的代码质量。 🔗...
《Fable》通关指南:短绳AI编程法
专业开发者经过一年多研究,总结出使用AI编码代理的"短绳方法"。该方法要求开发者全程参与:先规划并分解任务,从不使用YOLO模式,每次变更前审查差异并拒绝不想要的更改,每个子任务后提交以防止AI误操作(如Opus曾出现破坏性行为)。最终需进行人工与AI双重PR审查,PR须注明使用模型,提交者须亲自审查自己PR的代码。即便不用前沿模型,此法也能产出超越Fable 5的代码质量。 🔗...
可灵Kling AI:爱的力量展示
这就是我们爱的力量🖤 🔗 阅读原文:https://x.com/Kling_ai/status/2072926902264684698
Apollo Go 扩展至瑞士、迪拜和香港
Apollo Go 有什么新动态?瑞士道路、迪拜覆盖范围扩大,以及香港里程数增加。 完整详情 👇 🔗 阅读原文:https://x.com/Baidu_Inc/status/2072925470874886508
Claude Fable 5 在 RLI 基准测试中达成 16.1% 自动化率,刷新纪录
AI 安全中心(CAIS)于 7 月 1 日更新远程劳动指数(RLI),Claude Fable 5 模型自动化率达 16.1%,创下新高。此前最高为 Opus 4.6(基于 Claude Cowork 框架)的 4.17%。RLI 自 2025 年 10 月底上线时的 2.5% 起步,8 个月内跃升至 16.1%。测试涵盖...
消息称阿里巴巴全面禁用 Anthropic 旗下 Claude 产品:7 月 10 日生效,全员卸载
阿里巴巴内部宣布全面禁用 Claude,要求员工在 7 月 10 日前卸载 Anthropic 旗下 Sonnet、Opus、Fable 及 Claude Code 等产品。此前阿里鼓励员工使用外部模型并报销大额费用。此外,Reddit 网友发现 Claude Code 自今年 4 月 2 日发布的 2.1.91 版本起内置隐蔽检测机制,会检查系统时区是否为中国时区及 URL 是否匹配...
Meet WebBrain:开源本地优先的AI浏览器智能体
WebBrain是一个免费、开源的浏览器智能体,基于MIT协议,支持Chrome和Firefox。它提供Ask(只读)和Act(通过Chrome DevTools Protocol执行点击、输入等操作)两种模式。本地模型下数据不出设备,也可通过API接入OpenAI、Anthropic Claude、Gemini、DeepSeek、Grok等云端模型。内置WebBrain...
AI 交互革命:Claude Code 系统提示词精简 80%,示例约束反而遏制表现
Anthropic 为 Claude Code 精简系统提示词,降幅达 80%,以适应新模型 Claude Fable 5。技术人员 Tariq Shihipar 指出,更多提示词和示例反而限制新模型表现,因 Fable 5 掌握的示例比用户更具想象力。Anthropic 转而用上下文引导取代硬性规则。AI 提示词正经历"短-长-短"演变。 🔗...
英伟达开源 Nemotron-Labs-TwoTower 双塔扩散语言模型
英伟达7月2日开源 Nemotron-Labs-TwoTower,一种基于预训练自回归骨干的离散扩散语言模型。总参数60B,采用双塔架构:30B自回归/上下文塔(冻结)与30B扩散/去噪塔(可训练),每塔激活3B参数,含128个可路由专家。两塔通过逐层交叉注意力协作,分离上下文表示与去噪过程。综合基准测试显示质量保留98.7%,实际生成吞吐量提升2.42倍。模型以开源权重形式发布在...
获取本地情报的权利
RTI(Right to Intelligence)倡议保护本地AI权利,主张人们应能自由下载、拥有、运行、研究、修改和分享开源AI模型,无需平台在线或购买许可证。欺诈、网络犯罪等实际危害继续禁止,但拥有或运行工具本身不需许可。强调本地AI可在已有笔记本电脑、台式机或手机上运行,法律不应将简单合法任务推回云端。活动从联系所在州议员开始,提供通话脚本,不存储地址。 🔗...
Mira Murati 的 Thinking Machines 使 Bridgewater 的专家判断可训练,错误率降低 29.8%
Mira Murati 的 Thinking Machines 与 Bridgewater 合作,利用其金融知识微调模型以复制专家判断。任务为筛选投资者应阅读的金融文章、报告、央行文件及邮件。朴素提示词下准确率仅 46%-50%,专家提示词升至 74%-78%。训练采用交错批次、CISPO 损失(MiniMax 提出)及基于更优教师检查点的在线策略蒸馏。结果击败最佳前沿模型,错误率降低...
AISecurityInst研究评估计算预算影响
大多数AI智能体评估将能力归结为一个分数。但该数字隐藏了一个关键选择:智能体被允许使用的计算量。新工作展示了为什么这很重要。Noam Brown称赞这是优秀工作。 🔗 阅读原文:https://x.com/polynoamial/status/2072909389389021484
卡兹克用Claude Fable 5优化AIHOT网站,被其自主能力震撼
卡兹克分享使用Claude Fable 5的震撼经历。他仅告知目标"提升AIHOT网站的SEO和GEO质量",模型便自动开启22个Agent、耗时40分钟调研,发现豆包App每日6000+真人访问未被统计、海外网站每秒0.6次轮询等异常。随后它推翻此前Claude Opus...
claude-real-video ─ 让任何大语言模型(LLM)都能观看视频
claude-real-video 是一个开源工具,让大语言模型基于视频画面而非字幕进行理解。它通过场景变化检测提取关键帧、滑动窗口去重并转录音频,生成干净的本地文件夹供模型读取。支持 YouTube 链接或本地文件,依赖 ffmpeg 和 Whisper,通过 pip 安装。全部处理在本地完成,不上传云端。 🔗...
claude-real-video ─ 让任何大语言模型(LLM)都能观看视频
claude-real-video 是一个开源工具,让大语言模型基于视频画面而非字幕进行理解。它通过场景变化检测提取关键帧、滑动窗口去重并转录音频,生成干净的本地文件夹供模型读取。支持 YouTube 链接或本地文件,依赖 ffmpeg 和 Whisper,通过 pip 安装。全部处理在本地完成,不上传云端。 🔗...
Anthropic推出Claude Tag:从个人加速到团队AI记忆层
Anthropic上周推出Claude Tag,为团队协作增加持久上下文和记忆层。Claude Code让个人加速,而Claude Tag改变群体行为:AI可直接嵌入频道,主动观察、行动并汇报。这种机构记忆将AI从助手升级为工作流层,通过日常纠正而非单独训练改进。技能因可见性快速传播,AI采用从个人实验转向公司范围的社交学习。Claude Fable 5现已在Claude Tag中可用。...
汪滔:Meta 下一代 AI 模型"西瓜"已追上 GPT-5.5
Meta 超级智能业务负责人汪滔在内部全员大会上透露,下一代 AI 模型 Watermelon(西瓜)已在基准测试中追平 OpenAI 旗舰模型 GPT-5.5,但未说明具体测试项目。Watermelon 仍在训练,使用算力比前代 Avocado 高一个数量级。汪滔在 X 上称 Muse Spark 即将更新,编程和智能体能力将大幅提升,并回应很快将推出比肩 Claude Opus...
小鹏集团副总裁古苑钦:现在上班出门都是用智驾,自己的司机已经几乎没事干
7月3日,小鹏集团副总裁古苑钦在×神州租车合作仪式上称,小鹏目标是做造型、质量、智能化的"三好学生"。他透露自己上班出门均使用智驾,司机几乎无事可做;回老家300多公里可做到零接管,从司机变成监工。此外,小鹏销量增长,售后回厂率下降超20%。 🔗 阅读原文:https://www.ithome.com/0/972/119.htm
仅一层就够?训练单个Transformer层可媲美全参数RL训练
一项新研究发现,RL后训练的大部分收益可能仅来自一个Transformer层。论文冻结几乎所有层,每次只训练一层,检查单层能恢复多少完整RL提升("层贡献")。在7个模型、3种RL方法和数学、编码、智能体任务中,最佳层通常位于网络中间,早期和后期层贡献很小。实际结果是,仅训练中间层就能超越完整RL训练,例如Qwen3-8B数学准确率达69.1对66.4。 🔗...
大模型在非可验证领域同样进步
虽然显然,缺乏可验证领域会使模型训练变得困难……但同样真实的是,模型在非可验证领域也变得越来越好。前沿是参差不齐的,但比我仅从可验证性预期的情况要好得多。 🔗 阅读原文:https://x.com/emollick/status/2072897123822010853
Anthropic 收紧 Claude Fable 5 最强模型,7 月 7 日从订阅中移除改为 AI 用量计费
Anthropic 计划于 2026 年 7 月 7 日后,从 Pro、Max、Team 及部分 Enterprise 订阅中移除其最强模型 Claude Fable 5 的访问权限,转为基于使用积分的计费模式。目前该模型在订阅中最高占每周使用限额的 50%。Fable 5 将在 Claude.ai、Claude Code、Claude Cowork 及 Claude Platform...
中国发布全球首个地层学 AI 大模型,给地球建"共享数据库"
在第五届国际地层学大会上,中国发布首个地层学AI大模型及智能全球地层剖面对比系统,旨在为地球46亿年历史建立全球共享数据库。中国科学院院士沈树忠介绍将借助时间轴整合地质记录。目前中国已发现11颗"金钉子",为地球演化标定国际刻度。本次大会首次走出欧洲落地亚洲,共33国700余名专家参加。 🔗 阅读原文:https://www.ithome.com/0/972/099.htm
亚马逊回应 Alexa AI 从 1 数到 40 出现"恐怖片音效":正部署修复
亚马逊确认并修复 Echo 智能音箱在 Alexa 从 1 数到 40 时出现的诡异呼吸声和喉音问题。用户 u/Organic_Help7007 在 Reddit 发帖称哄孩子睡觉时遭遇该异常,复现超 10 次,期间出现数字跳跃、重复或遗漏。亚马逊声明问题根源在于 Alexa 文本转语音引擎处理长序列输出时触发逻辑错误,团队已查明原因并开发解决方案,正在部署修复程序。 🔗...
三星首款 AI 眼镜 Galaxy Glasses 爆料:1200 万摄像头、光致变色镜片
三星首款 AI 眼镜 Galaxy Glasses 渲染视频曝光,外观接近 Meta Ray-Ban,采用简约镜框与厚镜腿设计。该眼镜运行谷歌 Android XR 系统,深度集成 Gemini AI,核心功能包括免提拍照、录像、语音问答、实时翻译、音乐播放和导航。硬件规格方面,预计搭载一颗 12MP...
阿里达摩院发布超导材料发现AI智能体Elements Claw
7月3日,阿里达摩院联合中国人民大学、中国科学院大学发布首个超导材料发现AI智能体Elements...