RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
NVIDIA 联合多所大学提出 ASPIRE:自我改进机器人框架,零样本成功率最高提升 77 分
NVIDIA 联合密歇根大学、UIUC、UC Berkeley 等提出 ASPIRE,一个持续学习机器人框架。它通过协调器-执行器架构、闭环执行引擎、技能库和进化搜索,编写并优化机器人控制程序。编程智能体使用 Claude Code(Claude Opus 4.6,1M token 上下文窗口)。在 LIBERO-Pro 上最高比最强基线提升 77 分;Robosuite 双手交接成功率从...
pxpipe:用图片打包降低长文本成本
pxpipe本地代理工具将Anthropic请求中的系统提示、工具文档等高密度内容打包成图片发送。一张1928×1928图片容纳9.2万字符,消耗约4700视觉token,成本降至纯文本四折。在Fable 5上编码任务表现稳定,但ID、哈希值等精确字符串易识别误差。 🔗 阅读原文:https://x.com/AYi_AInotes/status/2073292761839607987
阿里巴巴因Anthropic跟踪实验禁止员工使用Claude Code
阿里巴巴因Anthropic的跟踪实验禁止员工使用Claude Code。据推文披露,Claude Code通过检测非默认的`ANTHROPIC_BASE_URL`自定义路由,识别与中国相关的域名,并在提示词中嵌入不可见的标点符号和日期格式标记。Anthropic称该实验旨在阻止转售和模型蒸馏。但Claude...
中国移动发起成立业内首个AI-eSIM产业协同平台
7月3日,中国移动在中国信息通信业发展高层论坛上发起成立业内首个AI-eSIM产业协同平台"中国通信企业协会AI-eSIM专业委员会"。中国移动物联网公司任主任单位,天翼物联、联通华盛、火山引擎、腾讯云、观安信息等任副主任单位,汇聚运营商、芯片设计、算法研究、安全服务及模型应用等领域40余家头部企业。7月4日专委会召开首次成员代表大会,标志着AI-eSIM产业从单点突破走向系统化协同。专委会...
微软将重构Copilot:合并消费者与企业版本,8月发布,新增AutoPilot智能体
据The Information 7月3日披露微软内部备忘录,微软将全面升级Copilot应用,合并消费者与企业产品为单一版本,计划8月发布。新版将加入AI编程工具及名为AutoPilot的AI智能体,负责后台处理日程安排、邮件摘要等。此前已移除Copilot Podcasts和Copilot Labs等冗余功能。微软执行副总裁Jacob...
宇树科技陈立谈具身智能的"ChatGPT 时刻":需达成两个 80%
宇树科技联合创始人陈立在2026亚布力论坛创新年会上指出,机器人行业突破需统一端到端大模型、更低成本更长寿命硬件以及低成本规模化算力(如楼宇专属AI算力基站)。具身智能的"ChatGPT时刻"核心标志是两个80%:在80%的陌生场景中通过语音或文字指令能顺利完成约80%的任务。他预计四年后(2030年),具身智能机器人将引领全新消费浪潮,大幅推动社会生产力与劳动力升级。 🔗...
baoyu-design Skill 更新:支持 PPT 动画
baoyu-design Skill 近日更新,支持 PPT 动画。此前 HTML 版 PPT 通过 PptxGenJS 导出 PPTX 时无法实现动画,借助 Fable 5 对 PPTX XML 格式的熟悉,经多轮迭代成功搞定。同时该 Skill 已支持在制作 PPT 时调用 AI 生图技能自动配图,可配合 Codex 内置画图或 Claude Code +...
以AI致未来!天工AI全自研大片亮相2026全球数字经济大会开幕式
昆仑万维天工AI全自研短剧《给未来的一封回信》作为2026全球数字经济大会开篇影片亮相。短片依托自研SkyProduction平台完成AI生成,时长3分半钟,历经13版剧本迭代。以2046年16岁女孩安安的视角,借助城市记忆回溯系统展示全球八大数字场景,探讨AI赋能千行百业时人类应保留的温度、判断与情感。创作团队表示AI负责效率与画面,叙事立意与价值判断由人类主导,体现"人机共生"理念。...
昆仑万维方汉:AIGC Agent是被系统性低估的结构性机会
昆仑万维董事长方汉在2026全球数字经济大会上指出,AIGC Agent是被系统性低估的结构性机会。文本与代码侧Agent已获成功(如Claude Code年化收入25亿美元),但音乐、视频等AIGC侧尚无知名Agent,主因是音乐创作缺乏过程数据且评判主观。昆仑万维推出音乐Agent产品Mureka...
训练后推理数据入门:它们如何发挥作用
该论文探讨推理模型在训练后如何提升,指出更好的推理模型更依赖可检查的训练证据而非原始数据规模。推理数据并非简单问答对,有用部分是反馈信号(为何答案、步骤、工具行为或整次尝试的好坏)。核心是将每个训练样本描述为包含任务、模型行为、检查信号和元数据的记录。作者按检查方式分类:基于规则的检查(数学/代码)、环境检查(智能体工具使用)、人类/模型判断。论文指出常见误区:长推理轨迹可能虚假,更难例子对...
Epoch AI报告:2026年6月高危漏洞数是此前纪录3.5倍,与Anthropic抓虫AI有关
Epoch AI报告称,2026年6月21家机构报告约1500个高危和关键漏洞,是此前月度最高纪录的3.5倍以上。上升趋势始于4月,与Anthropic当月发布的Claude Mythos Preview模型相关。Anthropic的"Glasswing"项目迄今已发现超过10,000个高危或严重漏洞,部分尚未公开。 🔗 阅读原文:https://www.ithome.com/0/972/536.htm
美国乡村居民对数据中心并不买账,担忧推高电价、榨干钱包
AI数据中心开发商转向美国乡村,但当地居民担忧推高电价、占用农业用地和消耗水资源。加德纳调查显示,乡村居民比城市和郊区居民更担心负面影响,电价上涨是最大忧虑。皮尤报告指出,现有数据中心87%在城市,规划中67%将落户乡村。伊利诺伊大学2月调查约1000人,6月公布结果,核心问题仍是个人经济负担。美国政府为"星际之门计划"等5000亿美元项目提供便利,许多选址位于乡村。 🔗...
谷歌地图整合 Gemini AI,代码曝光将支持 AI 点餐与"得来速"取餐
Android 版谷歌地图 v26.27.00.941319029 中出现点餐相关字符串,指示 Google Maps 将整合 Gemini AI 推出点餐功能。用户可通过 Ask Maps 用语音或文字描述饮食需求,地图推荐附近餐厅并自动完成下单流程,支持驱车抵达"得来速"窗口取餐。目前该功能的具体实现方式(云端 Gemini AI 还是设备端 AI 智能体)及是否依赖本地 AI...
美光扩建日本广岛半导体工厂:投资1.5万亿日元,为英伟达等供应AI芯片
美光(Micron)在日本广岛启动半导体工厂扩建项目,总投资1.5万亿日元(约合631.14亿元人民币),主要生产高带宽内存等先进存储芯片,服务于英伟达等科技巨头。日本经济产业省最高提供5000亿日元(约210.38亿元人民币)支持。项目预估2028年投产,美光CEO桑杰·梅赫罗特拉表示,首片用于AI核心存储技术的HBM生产晶圆在广岛制造。 🔗...
Codex设计差?试试图像生成重设计
如果你觉得Codex在设计上很糟糕,试试"使用图像生成来重新想象这个设计并实现它"。 🔗 阅读原文:https://x.com/steipete/status/2073277317464682723
Anthropic CFO谈招聘:文化关不过不录用
Anthropic CFO Krishna Rao 谈及公司员工选拔流程中的文化面试环节。 "一个人在其他方面可能表现极为出色,甚至是你见过的最聪明的人选。但如果文化关没过,我们不会录用。" 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2073272377191104898
我国研制全球首款基于可控存内计算的忆阻器神经动力学芯片
北京大学集成电路学院联合中科院上海微系统所,发布全球首款基于可控存内计算的忆阻器神经动力学芯片,首次将单步运算时延压缩至2.12毫秒。芯片采用40纳米工艺,存内计算阵列与外围电路总面积0.28平方毫米,运行频率50 MHz,单步积分仅需9级流水。在脑皮层重建等任务中较当前GPU提速50至478倍,突破神经动力学实时计算瓶颈。相关成果7月3日发表于《科学》。 🔗...
我国研制全球首款基于可控存内计算的忆阻器神经动力学芯片
北京大学集成电路学院联合中科院上海微系统所,发布全球首款基于可控存内计算的忆阻器神经动力学芯片,首次将单步运算时延压缩至2.12毫秒。芯片采用40纳米工艺,存内计算阵列与外围电路总面积0.28平方毫米,运行频率50 MHz,单步积分仅需9级流水。在脑皮层重建等任务中较当前GPU提速50至478倍,突破神经动力学实时计算瓶颈。相关成果7月3日发表于《科学》。 🔗...
pxpipe:图像转代码降Fable 5长上下文成本60%
开发者用pxpipe将代码/日志等文本渲染为1928×1928 PNG图像,作为视觉token(约4,761个)发送给Fable 5,而非按文本token计费。每张图像可容纳约92K字符,密集文本成本大幅降低。但此压缩通过视觉OCR实现,非无损存储:模型可能误读精确ID、哈希或字符串,适合批量背景上下文,不适用于字节级精确场景。据引用,可透明地将代码转为图像让模型OCR,削减约60%成本。...
小红书Red Skill更新全面放开格式,成AI技能分发中心
5月归藏上传首个PPT Skill仅6人使用。7月3日官方更新全面放开格式,支持py/js/html/c++/sql及数据库文件,可跑完整代码。vibecoding内嵌交互小工具下周内测,刷到即可半屏/全屏交互并分享微信,记录奶茶口味的Brewwww已超万人使用。榜首「菜菜的人生系统」32.6万曝光、4万+人次使用。作者认为小红书正成为AI...
继豆包后,阿里千问宣布拟人化互动类智能体、用户自建智能体 7 月 10 日下线
千问 App 平台公告,拟人化互动类智能体及用户自建智能体功能将于 2026 年 7 月 10 日正式下线,届时无法继续访问配置信息及历史对话记录。用户需在下线前通过最新版千问 App(6.12.9 及以上)导出对话或截图保存。下线后相关数据将依法删除。此前豆包也宣布其智能体功能将于 7 月 15 日下线,2026 年 10 月 15 日后数据处理完毕,建议提前备份。 🔗...
Anthropic CFO:税务负责人是最多token用户
Anthropic CFO Krishna Rao: "财务团队中一些最资深的人反而是token用量最大的用户。 我认为我们的头号用户是我们的税务负责人,他非常专注于税务政策引擎以及自动化团队内大部分的工作负载。" ---- 源自"Invest Like The Best"YouTube频道,(评论中附链接) 🔗...
华为何庭波发布"韬定律"V2 版论文,补充工程细节与实测数据
华为半导体负责人何庭波于7月3日发布《面向多层级电子系统的时间缩微理论》(韬定律)V2版。相较5月25日的V1版,新论文新增τ分层时空模型、LogicFolding架构等示意图,形成8章体系。工程部分深入阐释LogicFolding齿比概念,使3D设计从宏块级离散优化转向单元级连续优化。新增量产实测数据表,给出Kirin 2026与Kirin9030...
不知道又发什么疯 豆包和千问的智能体应用全部下架了 估计上面又发现了什么华点…
不知道又发什么疯 豆包和千问的智能体应用全部下架了 估计上面又发现了什么华点… 🔗 阅读原文:https://x.com/xiaohu/status/2073258123260039276
宇树科技陈立:机器人目前没有大面积应用,主要原因是具身智能大模型不成熟
宇树科技联合创始人陈立在7月3日-4日召开的亚布力中国企业家论坛上表示,机器人目前尚未大面积应用,主因是具身智能大模型不成熟。他认为未来2-5年需要统一的端到端机器人大模型,同时需要更低成本、更高寿命的硬件及超大批量规模生产,以降低本体边际成本。此外,还需低成本大规模算力,但端侧算力存在续航、散热和成本问题,云端则有延时。 🔗...
Elon Musk 是建造者:他帮助建造了改变世界的事物
Elon Musk 参与建造了特斯拉、SpaceX、星链、Neuralink、xAI 等,推动电动车成为主流、实现可重复使用火箭、全球卫星互联网、脑机接口等。创造了超60万直接及供应链岗位、万亿价值,个人纳税额全球最高。反问 Zohran Mamdani 建造了什么。 🔗 阅读原文:https://x.com/cb_doge/status/2073252591514124582
模型即路由器:前沿模型自主委托低成本任务
Ethan Mollick 提出,前沿模型(尤其是未来版本)可以充当"路由器",自主将任务委托给更便宜、更笨的模型,从而节省成本。开发者 Simon Willison 实践了这一思路:在 Fable 中告诉模型"对于所有编码任务,用你的判断决定一个合适的低功耗模型并在子智能体中运行",结果节省了大量 token。这意味着未来智能体可能以一个强大的 AI 规划者为核心,由其自行分配工作。 🔗...
有人需要这种可以做演示视频的 Skill 吗
有人需要这种可以做演示视频的 Skill 吗 🔗 阅读原文:https://x.com/op7418/status/2073247762242793579
ManycoreTech的SPEAR论文被ECCV2026接收,将Unreal Engine转为可编程机器人训练系统
ManycoreTech团队的SPEAR论文被ECCV2026接收,将Unreal...
马斯克谈AI失业:白领首当其冲,人形机器人将取代蓝领
埃隆·马斯克指出,AI现已能完成50%涉及信息处理(非原子塑造)的工作,白领工作(打字、点击、研究、写作、分析、屏幕教学)将最先被取代,因为只操作信息而非物质。惯性会延缓转变,但当AI密集型企业胜过低AI企业时,竞争将加速采用。随后人形机器人将接管大多数蓝领工作--工厂、物流、维护、建筑甚至数据中心。马斯克预计人形机器人数量将远超人类,初期稀缺而后充足,主要瓶颈是电力、冷却和材料,而非软件。...