RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
面壁智能与清华NLP提出长上下文推理数据配方,无需特殊奖励工程
面壁智能(OpenBMB)联合清华NLP提出,仅靠精心设计的数据配方与极简GRPO即可显著提升长上下文推理,无需特殊奖励工程。该方法将推理分解为检索、多证据合成与推理三种能力,构建8个数据集(约1.4万条样本)训练。在Qwen3-4B/8B/30B-A3B上,七个长上下文基准平均提升+7.2/+3.2/+6.4,效果可泛化至512K+ token。 🔗...
宇树发布轮足机器人 As2-W:速度 6m/s、IP54 级防水、空载续航距离超 30km
宇树科技发布轮足机器人 As2-W,在年初 As2 基础上增加四个主动轮,结合轮式速度与四足越障能力。该机器人可实现 6m/s 高速疾驰,具备 IP54 级防水,空载续航距离超 30km,自重约 25kg,负重可达 180kg,并搭载预训练 RL 模型 6.0。 🔗 阅读原文:https://www.ithome.com/0/981/372.htm via AI HOT ·...
普通人写Skills无需额外配置API
Berry Xia指出,普通人编写Skills时,只要选对对应工具的模型,大多根本不用额外配置API。直接调用工具内置的API即可,能砍掉大量繁琐操作,大幅降低上手门槛。不少人刚入门就被API配置劝退。 🔗 阅读原文:https://x.com/berryxia/status/2080633622357549103 via AI HOT ·...
百度搭子更新:电脑手机接力、桌面端内嵌浏览器上线,复杂任务可跨端连续执行
百度搭子在近期AI Day上推出多项升级,支持电脑与手机双端互联,同步任务上下文与执行进度,用户可跨设备接力完成复杂工作。桌面端内嵌浏览器正式上线,能自动打开多个网页执行调研、下载等操作,手机端支持云端远程操控。智能路由自动匹配任务模式,平均任务耗时降低20%,Token利用率提升25%;简单任务完成度达100%,复杂任务高交付率94%,积分消耗最高降低75%。 🔗...
百度搭子更新:电脑手机接力、桌面端内嵌浏览器上线,复杂任务可跨端连续执行
百度搭子在近期AI Day上推出多项升级,支持电脑与手机双端互联,同步任务上下文与执行进度,用户可跨设备接力完成复杂工作。桌面端内嵌浏览器正式上线,能自动打开多个网页执行调研、下载等操作,手机端支持云端远程操控。智能路由自动匹配任务模式,平均任务耗时降低20%,Token利用率提升25%;简单任务完成度达100%,复杂任务高交付率94%,积分消耗最高降低75%。 🔗...
百度石清华在APEC提出AI发展"向上、向深、向善",以DAA衡量AI生产力
百度副总裁石清华在APEC数智赋能高级别对话上提出,AI发展应坚持"向上、向深、向善",并引入"日活智能体数"(DAA)作为衡量AI生产力的新指标。百度自研平台"秒哒"已落地200+业务场景,创建350万+可商用应用,累计服务超3500万人。 🔗 阅读原文:https://mp.weixin.qq.com/s/13_g-Fj9qHJEVFBtGUcAlQ via AI HOT ·...
Neuralink 发展历程对比展示
Neuralink 🧠 当初如何起步 vs. 如今进展如何 🔗 阅读原文:https://x.com/cb_doge/status/2080628668582522955 via AI HOT · https://aihot.virxact.com/items/cmrywy4sv062orolg5osg5ehw
Jason Liu 建议 Codex 先审视代码
告诉 codex 先看一眼。 🔗 阅读原文:https://x.com/jxnlco/status/2080628289777848429 via AI HOT · https://aihot.virxact.com/items/cmrywx0c7061hrolgpwnf4b69
《端侧智能2026:规模化落地元年》报告发布
北京智源人工智能研究院与端侧智能北京市重点实验室联合发布报告,指出2026年是端侧智能规模化落地的关键转折年。报告提出"密度定律",即模型最大能力密度约每3.5个月翻一番,MiniCPM5-1B以1B参数在Artificial Analysis上取得17.9分,与2024年5月发布的200B参数GPT-4o仅差零点几分。 🔗...
FLUX 3 x mimic:新一代视频动作模型
Black Forest Labs 发布多模态基础模型 FLUX 3,联合训练图像、视频和音频,其中视频预测占训练算力的 95% 以上。该模型与机器人公司 mimic 合作推出 FLUX-mimic,已在奥迪生产线上测试部署。加入动作预测后,视频生成质量最初下降最多 10%,但经 3500 步训练后恢复原有水平。 🔗...
FLUX 3 x mimic:新一代视频动作模型
Black Forest Labs 发布多模态基础模型 FLUX 3,联合训练图像、视频和音频,其中视频预测占训练算力的 95% 以上。该模型与机器人公司 mimic 合作推出 FLUX-mimic,已在奥迪生产线上测试部署。加入动作预测后,视频生成质量最初下降最多 10%,但经 3500 步训练后恢复原有水平。 🔗...
Anthropic 发布"Claude 食谱"教程合集
Anthropic 发布"Claude 食谱"合集,包含多个教程,覆盖从复现 Claude 智能体搜索基准分数到构建异步多智能体团队、部署生产级智能体等场景。教程还涉及 Memory 存储、Outcomes 自验证循环及从 OpenAI Agents SDK 迁移等实操内容。 🔗 阅读原文:https://platform.claude.com/cookbook via AI HOT ·...
中国信通院牵头,多媒体数据编织国际标准 ITU-T F.DF-RefFram 在 ITU-T 成功立项
中国信通院牵头的国际标准项目"多媒体数据编织系统要求与参考框架"(ITU-T F.DF-RefFram)在 ITU-T SG21 会议上正式立项。该标准拟规定多媒体数据编织系统的总体定位、功能要求与参考框架,重点解决分布式数据发现、语义管理与服务编排等共性技术问题,旨在降低多源异构数据的集成复杂度,为人工智能高质量数据供给提供标准化支撑。 🔗...
Meta 新基准 GAMUT 衡量 AI 回答的事实完整性
Meta 新论文提出,事实性不仅包括避免错误,还需包含足够的关键信息。新基准 GAMUT 通过构建结构化指南,将缺失信息转化为可衡量的 pass/fail 检查。在 14 个强模型测试中,最佳得分仅为 58.7%,信息缺失导致的失败比错误陈述更多。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2080620006526652699 via AI HOT...
软件质量持续下滑,但AI热潮下人人兴高采烈
尽管AI模型不断进步、编程效率承诺高涨,但实际软件体验却在全面恶化:银行App需多次FaceID验证、Slack窗口抢焦点导致命令误发、汽车系统更新后bug频出。作者认为,团队拥有最新模型和充足token预算却未能改善稳定性,根源在于厂商长期以KPI为导向,修复bug不如新功能"好看"。不过,这种集体"AI债务"正为独立开发者创造机会,用以往无法企及的工具构建更好的日常软件。 🔗...
美国拟以AI蒸馏为由制裁中国公司
美国正准备将AI蒸馏作为对抗中国的新武器。 据Axios报道: 白宫称月之暗面越界,秘密大规模复制Anthropic的Fable模型以构建Kimi K3。 财政部长斯科特·贝森特表示,被指控这样做的中国公司可能面临制裁或被列入实体清单。 在我看来,这读起来像是蒸馏指控现在已成为能够且想要禁止中国开源软件的法律依据。 🔗...
Claude 语音模式现已支持 Opus 和 Sonnet 模型
Anthropic 将 Claude 语音模式扩展至更强大的 Opus 和 Sonnet 模型,用户可在移动端、桌面端和网页聊天中随时切换模型。该模式支持 11 种语言,并能调用 Gmail、Google Calendar 等外部工具通过语音撰写和发送邮件。Anthropic 是目前唯一允许用户在语音模式下直接保存邮件的提供商。 🔗...
PixVerse 推出 GPT Image 2 隐藏功能
长按有惊喜!用「カクシエMAKER」轻松制作。😍 由 PixVerse 上的 GPT Image 2 生成 @PixVerse_ 🔗 阅读原文:https://x.com/PixVerse_/status/2080615070313427002 via AI HOT · https://aihot.virxact.com/items/cmryuuge105gnrolgle2o877w
每天集中注意力都变得越来越难了
作者发现自己如今能专注的时间很难超过1小时,即使在做期待已久的事情时也容易分心。分心源包括浏览无关链接、等待时刷手机、甚至整理床铺,而LLM的使用进一步加剧了问题--将任务外包给AI后,作者仍会不断思考其进展,导致无法真正专注于其他工作。作者认为,这种注意力碎片化部分源于工作环境中聊天工具和无效会议对专注力的侵蚀,以及被动浏览内容逐渐取代了主动思考活动。 🔗...
菲尔兹奖得主邓煜谈 AI:GPT 已能辅助数学证明,但不能替代独立思考
2026 年菲尔兹奖得主、芝加哥大学教授邓煜透露,他在数学研究中会使用 AI 辅助工具,GPT 曾帮助解决一个连续几天未能突破的数学特例。邓煜表示,AI 已让很多研究环节方便不少,能补充未知知识或给出简单证明,但该特例证明无法推广到一般情形,未写入最终论文。他强调,AI 不能替代独立判断与严格核验,尤其对刚进入科研的学生而言。 🔗...
生数科技在 WAIC 2026 展示通用世界模型最新进展
生数科技在 WAIC 2026 上展示了从数字世界生成到物理世界行动的通用世界模型。其视频生成模型 Vidu 已形成产品矩阵,实时交互模型 Vidu S1 支持 540P、最高 42FPS 的视频通话级输出。面向物理世界的世界动作模型 Motubrain 在 RoboTwin 2.0 榜单的 Clean 和 Randomized 场景下均位列第一。 🔗...
PRO-LONG:无损记忆让智能体长程推理提升18%
PRO-LONG方法通过将所有历史动作、观察和结果记录在可搜索的结构化文本日志中,而非丢弃信息,使AI智能体在长周期任务中推理更可靠。在ARC-AGI-3的25个隐藏规则游戏中,该方法让相同基础智能体平均提升18个百分点,同时比更强的专用系统节省4.2至5.8倍的计费token。论文表明,长期智能体记忆的最佳方案可能是无损存储加可编程检索。 🔗...
甲骨文裁员2.1万,OpenAI数据中心项目面临70亿担保难题
甲骨文裁员2.1万人后,其为OpenAI建设的威斯康星州近1吉瓦数据中心项目遭遇监管障碍。州监管机构要求甲骨文为该项目超70亿美元的电力基础设施提供担保,但甲骨文信用评级已降至BBB-,低于要求水平。若采用信用证担保,每年成本将超1亿美元。 🔗 阅读原文:https://x.com/kimmonismus/status/2080601397821891048 via AI HOT ·...
智元启动赴港上市流程,2025 年通用人形机器人出货量全球第一
智元已启动赴港上市流程。据 Omdia 统计,2025 年智元通用人形机器人出货量超 5100 台,位居全球第一,占据约 39% 市场份额。今年 6 月,其第 15000 台通用具身机器人精灵 G2 已量产下线。 🔗 阅读原文:https://www.ithome.com/0/981/350.htm via AI HOT ·...
OneCLI:开源凭证网关,防止AI智能体泄露机密信息
OneCLI 是一款开源凭证网关,专门设计用于防止 AI 智能体在操作中意外泄露 API 密钥、数据库密码等机密信息。它通过拦截和过滤 CLI 命令中的敏感凭证,确保只有经过授权的安全调用才能访问这些秘密。该项目已在 GitHub 上开源,旨在为使用 AI 代理的开发团队提供一道额外的安全防线。 🔗 阅读原文:https://github.com/onecli/onecli via AI...
蚂蚁百灵Ling-3.0-flash上线OpenCode免费使用
Token效率对于可持续使用极为重要。非常感谢@novita_labs和@opencode团队在发布日的合作! 🔗 阅读原文:https://x.com/AntLingAGI/status/2080598756899365101 via AI HOT · https://aihot.virxact.com/items/cmrysmkvs04qyrolgltjr1f9u
蚂蚁百灵 Ling-3.0-flash 获 SGLang 支持
感谢 @sgl_project 社区持续的高水准支持!继续打满~ 😇 🔗 阅读原文:https://x.com/AntLingAGI/status/2080598075962511369 via AI HOT · https://aihot.virxact.com/items/cmrysmkvt04qzrolg53u7uprv
亚马逊升级 Alexa+ AI 助手,支持购物、餐厅预订、叫车等任务
亚马逊今日宣布升级 Alexa+ AI 助手,支持自然对话、信息记忆和任务执行,可完成购物、餐厅预订、叫车等日常任务。Alexa+ 具备多模态能力和超强记忆力,打通了 Uber、OpenTable、Grubhub 等第三方服务接口,用户可通过语音直接叫车、订餐或点外卖。Alexa+ 还能在 Echo 音箱、手机 App、车载设备和网页端之间同步对话上下文,并提供个性化新闻摘要。 🔗...
小红书等提出 UniNote:统一多模态嵌入模型
小红书、上海交通大学、华中科技大学和北京理工大学联合提出 UniNote,将多模态表示学习与排序能力融合于单一模型。通过两阶段训练(对比 SFT 强化表示 + 强化学习排序优化),UniNote 在单次嵌入传递中实现与两阶段检索-排序范式相当的性能,并大幅降低延迟。 🔗 阅读原文:https://mp.weixin.qq.com/s/YFyKzcFo67rK3rvADvG4gg via...
阿里云与博世联合举办AI创新日
7月14-16日,阿里云与博世数字在上海、杭州、苏州三地举办AINNOVATION DAY,超120名参与者共同推动企业云与AI共创。活动在博世数字区域总裁夏玉虎博士等专家指导下,团队在数小时内将创意转化为方案,产出超40个项目,涵盖工业物联网、能源转型及AI冰箱等智能家居场景。 🔗...