RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
MoonMath AI 开源 AMD MI300X 注意力核,全面超越 AITER v3
MoonMath AI 团队开源了一款 bf16 前向注意力核,专为 AMD MI300X(gfx942)设计,使用 HIP 编写,MIT 许可。该核在所有测试形状和三种舍入模式下均超越 AMD 官方 AITER v3:几何平均加速比 1.18×(RTNE)、1.15×(RTNA)、1.08×(RTZ),最高单形状 1.26×。性能提升来自单指令 asm 包装和内存布局优化--K 置于...
华为智慧屏推送系统更新:新增儿童时长管控、畅连小窗调节等
华为智慧屏今日推送系统更新,主要新增或优化:标准模式新增儿童时长管控(设置>通用>使用时间管理);畅连小窗支持自由调节窗口大小;观看影视剧时可呼叫小艺进行人物、剧情等问答;超级桌面分辨率由1080P提升至2K;遥控器支持控制外接设备(需开启CEC);开关机菜单支持自定义预设焦点;智慧屏可与全屋吸顶音箱联动;AI语音唤醒准确率和响应时延优化;门锁画中画联动显示接听设备名称及位置,并支持挂断。官...
Sakana Fugu Ultra:多智能体编排系统对标Fable和Mythos
Sakana AI 推出 Fugu 多智能体编排系统,通过单一模型 API 调用即可协调多个前沿模型组成智能体团队。其 Fugu Ultra 模型性能与 Fable、Mythos 相当,且不受出口管制限制。主推文指出,Fugu Ultra 并非传统意义上的新基座模型,而是一个学习到的编排层,更智能的测试时编排可能是 AI 能力的下一个跃升点。 🔗...
Recall:Claude Code 的本地项目记忆工具
Recall 是为 Claude Code 设计的完全本地项目记忆工具。它自动记录每次会话日志(history.md),并通过 TF-IDF + TextRank 提取式摘要算法在本地生成压缩摘要(context.md,约 1-2K token),无需调用任何外部模型或 API 密钥。摘要完全在本地完成,不消耗 Claude Code 的模型...
小米汽车谈为何用自动驾驶挑战纽北:试探极限边缘,为了日常的安全保驾护航
小米汽车今日宣布,小米 YU7 GT 以 10 分 29 秒 483 的成绩达成全球首个纽北自动驾驶圈速纪录。小米汽车官方表示,这一圈速并非 YU7 GT 的硬件极限或智能驾驶算法能力的终点。选择纽北赛道,旨在通过极限赛道锤炼动态模型、高频扭矩分配和毫秒级救车能力,最终将这些能力逐步下放到普通用户的量产车上,帮助用户在暴雨、冰雪等极端工况下做出正确决策,将车辆拉回可控范围。 🔗...
特斯拉开始训练卡车版FSD?Semi电动重卡搭载真值校验设备现身
特斯拉Semi电动重卡被拍到搭载基准真值校验设备,现身加利福尼亚州森尼韦尔市。该设备常用于特斯拉监督式算法训练,表明特斯拉正在为商用车型完善FSD模型。此举有望缓解卡车司机的驾驶时长限制,对物流行业具有里程碑意义。不过落地可能面临技术挑战,类似Cybertruck的FSD因摄像头高度问题延迟,近期才获得真智能召唤(ASS)功能。 🔗...
微调 Qwen 3:0.6B 实现家庭问题分类,准确率从 10% 提升至 92%
一个个人项目通过微调仅 600M 参数的 Qwen 3:0.6B 模型,将其作为家庭问题分类器。基线测试中,仅靠提示词的原始模型在 131 条测试中仅正确分类 13 条(约 10%)。使用 Unsloth 框架和 QLoRA 微调后,准确率提升至 79%。进一步将分类标签改为无语义重叠的两字符不透明 ID(如 hvac 改为固定代码),准确率升至约 92%。训练数据集约 850 条,按...
阿里巴巴发布视频生成模型 HappyHorse 1.1
阿里巴巴今日发布视频生成模型 HappyHorse 1.1,在动态表现力、主体一致性、指令遵循、视觉质感和音频能力等维度系统性升级。技术规格与 1.0 版本一致,单次生成 3 到 15 秒,支持 720p 和 1080p 分辨率及自由宽高比。HappyHorse 官网、阿里云百炼和千问云均已接入最新版本。同日,HappyHorse 联合虎鲸文娱集团启动"Horsepower"AI...
Guinness Chen:用语音输入代替手动编辑提示词
Guinness Chen 表示,2026年6月了,别再手动编辑提示词,应该按住听写按钮即兴说上10分钟,把脑海里的每个碎片、警告、例子和感觉都交给模型--大语言模型最擅长的就是从语言中重建潜在意图。Jason Liu 称赞他只发好内容,观点总是很棒,并建议大家关注他 @guinnesschen。 🔗 阅读原文:https://x.com/jxnlco/status/2068949888784851140
DeepSWE 基准测试发布,GLM-5.2 与 Kimi-K2.7-Code 分别成为国产编程 SOTA 与性价比 SOTA
DeepSWE 基准测试发布榜单,GLM-5.2 为国产编程大模型 SOTA,Kimi-K2.7-Code 为性价比 SOTA。该榜单与 SWE-Bench-verified 不同:问题由人工针对开源项目制造,可避免数据泄露;每个问题需修改上百行代码,考验模型规划能力,且不提供工具指引,更贴近真实工程场景。覆盖 TypeScript、Go、Python、JavaScript、Rust...
PINE64 推出 PineVoice 智能音箱:基于 RISC-V 处理器,支持本地唤醒词检测
开源硬件制造商 PINE64 于本月 19 日推出 PineVoice 智能音箱,售价 49.99 美元(约 339.4 元人民币),可加购 14.99 美元的 Zigbee 加密狗。该音箱集成双麦克风阵列、音量控制和硬件麦克风静音按钮,基于博流智能 BL606P 无线多模网关芯片(含玄铁 C906 和 E907 内核),拥有 788KB SRAM、32MiB pSRAM 和 16MiB...
华为笔记 App 完成鸿蒙 PC 版适配,正式上线电脑端 App Gallery
华为笔记 App 已完成鸿蒙 PC 版本适配,正式上线鸿蒙电脑的华为应用市场 App Gallery。该应用是华为自研笔记软件,搭载专业笔刷引擎,内置多款笔刷和编排工具,支持实时 AI 字迹调整、无界笔记、自由作图、多人语音转写、手写公式 AI 识别、圈选小艺解题、智能摘要等功能。华为终端平板与 PC 产品线总裁朱懂东在 HDC 2026...
Nature研究:AI或削弱专业人士硬技能
一项发表于《自然》的研究指出,AI虽能节省时间,但可能削弱专业人士依赖的硬技能。波兰结肠镜研究显示,引入AI工作流后,有经验内镜医师独立操作的腺瘤检出率从28.4%降至22.4%。AI并非让人瞬间疏忽,而是改变了技能培养的"摩擦"机制--从主动搜索变为被动确认。类似现象也出现在软件开发中:一项2026年随机研究发现,AI辅助虽帮开发者完成任务,但过度委派削弱了概念理解、代码阅读和调试能力。...
郭明錤:谷歌开发 TPU v9 芯片推理优化升级款,联发科接单
郭明錤6月22日称,谷歌将在TPU v9基础上升级推理优化版,代号或为"Triggerfish",由联发科独家接单。该芯片旨在缓解"CPU墙"与"内存墙",片内SRAM缓存为原版2~3倍,片外DRAM升级至HBM4E。预计2027年底投产、2028年底放量,生命周期出货100~200万颗,单价高出约三成。此外引入"simulation die",可能用于本地TPU管理、训推切换等。 🔗...
海立开源第三本Agent书籍《Deep Agents in Action》
海立老师写书速度真快,开源了第三本书《Deep Agents in Action》。 如果你对Agent开发感兴趣,可收藏学习,很好的资料。 🔗 阅读原文:https://x.com/vista8/status/2068935883575754913
AI末日论被指为行业高估值提供依据,GLM-5.2等实际技术进展被忽略
作者在Berkeley观察到AI圈陷入"末日论"狂热,认为Anthropic等公司通过渲染AI急速发展、递归自我改进可能提前到来等恐慌来支撑估值,而非聚焦实际技术。相比之下,GLM-5.2博客展示了渐进改进的技术进步,该模型与Opus...
AI HOT 日报 · 2026-06-22 — 美团tabbit国际版免费接入GPT-5.5/Claude Opus 4.8等旗舰模型
美团tabbit国际版免费接入GPT-5.5/Claude Opus 4.8等旗舰模型 — 点击查看完整日报
Grok Build 推出 /goal 模式,支持长时间自主任务执行
xAI 在 Grok Build 中引入 `/goal` 新模式。用户只需用一行命令设定目标,agent 便会自动规划方案、分解任务为进度清单并持续执行,直至目标完成且通过验证,期间可额外下达指令。该模式支持监控与引导命令,任务完成时清单全部勾选。即日起可用,用户可通过 `curl -fsSL | bash` 安装 CLI 并登录账号即可使用。 🔗...
HAKARI-Bench:统一条件下比较检索架构与效率设置的轻量级基准
HAKARI-Bench 是一个轻量级检索基准,将现有检索套件重建为小型数据集(Nano-sets),涵盖 35 个基准、551 个任务和 43 种语言,采用统一格式实现模型无关比较。它支持 BM25、稠密、稀疏、晚交互和重排序五种检索家族及其效率变体(降维、量化等)在同一条件下对比。在 55 个模型上,整体排名与 MTEB retrieval v2、MMTEB v2 retrieval...
我们用免费本地模型对 OpenClaw 仓库进行实时分类
Hugging Face 在 OpenClaw 仓库上测试用 Gemma 和 Qwen 等本地模型实时分类 issue 和 PR。他们使用 Pi agent harness 驱动模型,配合 reposhell 只允许读操作防止提示词注入。测试的模型包括 gemma-4-26b-a4b 和 qwen3.6-35b-a3b,经性能优化后均可在本地生成数百 token/s。该方案运行在...
能力强但粗心:计算机使用智能体是否遵循情境完整性?
AgentCIBench评估计算机使用智能体(CUA)是否遵循情境完整性。它针对三种常见失败模式:视觉共置(智能体拉取任务目标旁边被禁止的项目)、任务模糊性过度分享(在提示不明确时泄露个人状态)以及收件人错配(向不适当的收件人发送内容)。对15个前沿CUA的评测显示平均泄漏率67.9%,其中11个在超过50%的场景中泄漏,这些失败在端到端任务中同样存在。AgentCIBench已发布,旨在推...
NSA局长:Mythos数小时内攻破其几乎所有机密系统
美国NSA局长称,Mythos在数小时内攻破了其几乎所有机密系统。此前Mythos已在5天内破解MacOS。而顶级漏洞团队Google Project...
美团tabbit国际版免费接入GPT-5.5/Claude Opus 4.8等旗舰模型
美团近期上线tabbit国际版应用,免费集成多家顶级AI模型的最新旗舰版,包括GPT-5.5、Claude Opus 4.8、Gemini 3.5 Flash,以及国内Kimi-2.6、GLM-5.1、MiniMax-M3。用户无需单独订阅即可使用这些模型。需注意:只有国际版包含海外模型,国内版仅提供国内模型。该应用旨在抢占AI入口,目前处于免费推广阶段。 🔗...
腾讯元宝父亲节活动:上传照片生成与年轻爸爸的合影
腾讯元宝推出父亲节主题活动,用户可选择爸爸年轻时照片与自己的照片,输入提示词(如"帮我生成一张和爸爸的合影,将图2的我融合到图1爸爸的照片中,我想穿越回__年前,和他一起_____;保留爸爸照片的背景、动作及五官;人物姿态自然协调,整体光线与色调保持一致"),元宝即可生成合影。活动旨在让用户"回到过去"看到爸爸的青春模样。 🔗...
AI HOT 日报 · 2026-06-21 — 微软双向转售GPT与DeepSeek成全球最大AI中间商
微软双向转售GPT与DeepSeek成全球最大AI中间商 — 点击查看完整日报
Anthropic IPO或延迟,OpenAI抢跑融资
在这一点上,我很容易看到围绕Anthropic的戏剧性事件会迫使其推迟IPO,而OpenAI则竭尽全力抢先上市并在此过程中筹集更多资金。
从PGP到Mythos:出口管制未能阻止任何人的简史
美国白宫以国家安全为由,命令Anthropic限制AI模型Fable 5和Mythos出口,导致两款模型暂停向美国境外用户及境内外国公民提供服务。此前Anthropic仅向约150家受审查企业和政府机构开放Mythos。触发禁令的两个事件:Anthropic向一家被怀疑与中国有关联的韩国电信公司(普遍报道为SK电信)提供Mythos访问权限;亚马逊CEO称其研究人员找到了绕过Fable...
特斯拉AI工程师:ML训练仅占2%,数据质量定上限
特斯拉AI高级工程师(从事自动驾驶与机器人ML)揭露ML项目真实时间分配:50%评估、40%数据清洗、8%集成、2%训练。前两项共同设定学习的噪声底限,模型无法降低--这是数据的香农最优界。他每天思考本体论(ontology),旧标签必须持续审查,因为生产系统中分布漂移与边缘用例不断暴露标签缺陷。核心结论:训练不是瓶颈,清理现实数据的能力才是关键。
欧洲零售协会要求欧盟豁免非欺骗性AI广告的"深度伪造"标注义务
欧洲零售协会Eurocommerce(成员包括Amazon、H&M、Inditex、Ikea)致信欧盟科技专员Henna Virkkunen,要求对非欺骗性AI生成广告图像豁免EU AI...
AlphaFold 之父 John Jumper 离开 Google DeepMind,加入 Anthropic
诺贝尔化学奖得主、AlphaFold 团队负责人 John Jumper 宣布离开 Google DeepMind,加入 Anthropic(休息一段时间后)。他在 GDM 工作近 9 年,博士毕业仅 6 个月便被 Demis Hassabis 委以重任领导 AlphaFold,实现了蛋白质结构预测突破。此前已有大批 OpenAI 核心研究员流入 Anthropic,Jeff Dean...