RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
自用AI前端设计Skill即将开源
开发者Vista自研的前端设计Skill,通过调用Subagent并行生成四个设计方向,并弹出本地服务器预览,选中后回传Codex或Claude Code。该Skill内置58个知名网站的设计Markdown文档,能根据主题自动抽取排版、配色等元素完成设计。已在Claude Code和Zcode中表现良好,预计本周开源。 🔗...
Chollet:现实皆可编程,建模是关键
所有现实都是可编程的。 你只需要弄清楚如何做。 而方法就是建模。 🔗 阅读原文:https://x.com/fchollet/status/2073927440779694477 via AI HOT · https://aihot.virxact.com/items/cmr8id6dc02gdsl0d71kb7hhi
Google 工程负责人 Addy Osmani 开源 Agent Skills:24 个生产级工程技能
Agent Skills 由 Google 工程负责人 Addy Osmani 开源,包含 24 个生产级工程技能,旨在强制 AI 编码 Agent 遵循规范,避免跳过规格、测试和安全评审。项目定义六阶段生命周期(DEFINE→PLAN→BUILD→VERIFY→REVIEW→SHIP)和 8 个 slash 命令入口,技能按上下文自动触发。特殊设计包括...
NVIDIA 推出新计划:AI 初创公司可用未来收益分成换取 GPU 计算资源
NVIDIA 推出新计划,允许 AI 初创公司以未来产品和云收入的分成换取高性能计算资源。NVIDIA 通过硬件销售和持续从这些 GPU 产生的云收入中抽成实现双重获利。该计划主要面向专业 GPU 云提供商(neoclouds),帮助它们借助 NVIDIA 信用支持和收入分成结构采购基础设施,再租给需要训练、微调和大规模推理的 AI 初创公司,将 GPU...
Jason Liu:艺术形式之间不可相互替代
相机拍摄的图像永远无法媲美画作。 广播节目永远无法媲美百老汇演出。 电视剧永远无法媲美电影。 文字故事永远无法媲美代代相传的口述遗产。 电子游戏永远无法媲美书籍。 🔗 阅读原文:https://x.com/jxnlco/status/2073922272596013387 via AI HOT ·...
我的网站被攻击48小时,Claude Fable 5替我防下了这一切
自称"反AI小队(#TeamAntiAI)"的攻击者对AI资讯网站AIHOT发动近两天攻击。第一波236万次图片接口请求峰值每分钟87万次(平时340倍);第二波多IP协同向反馈接口灌入3万多条垃圾数据,并爆破另一未设防项目域名868万次,导致nginx并发上限768被占满,全站瘫痪。Claude Fable...
AI HOT 日报 · 2026-07-06 — 美团 LongCat-2.0 完全开源(MIT 许可),1.6T MoE 模型开放权重与推理代码
美团 LongCat-2.0 完全开源(MIT 许可),1.6T MoE 模型开放权重与推理代码 — 点击查看完整日报 via AI HOT · https://aihot.virxact.com/daily/2026-07-06
AI 世界观
《经济学人》以世界价值观调查评测 25 个前沿 AI 模型。实验室来源对世界观的预测力弱于训练与对齐选择:Gemini 与 Qwen 立场接近,GPT-4o 与 DeepSeek R1 近乎相同,而 DeepSeek R1 与 DeepSeek V4 Flash 则截然不同。模型的世界观在代码生成中不可见,但在商业分析、预测、招聘与政策工作中是活跃的输入变量。 🔗...
xAI 为 Grok Voice 新增 21 个旗舰语音
xAI 发布 21 个新旗舰语音,加入原有的 5 个语音。所有新语音均支持多语言,已在实时 Voice Agent API、Text to Speech API 及新推出的 Grok Voice Agent Builder 中可用。每个语音针对客服、角色、解说、广告、教育等场景定制,支持通过 `【pause】` 等语音标签控制表达。原始 5...
LLM-as-a-Verifier:一种通用验证框架
LLM-as-a-Verifier 是一种无需额外训练的通用验证框架,通过计算评分 token logits 分布的期望生成连续分数,实现细粒度反馈。该框架在 Terminal-Bench V2(86.5%)、SWE-Bench Verified(78.2%)、RoboRewardBench(87.4%)和 MedAgentBench(73.3%)上取得 SOTA 性能。其细粒度信号可用于...
统一音频智能模型 Nemotron-Labs-Audex-30B-A3B 发布
Nemotron-Labs-Audex-30B-A3B(Audex)是基于Nemotron-Cascade-2-30B-A3B的MoE大语言模型,采用单一Transformer解码器统一处理文本与量化音频token。训练使用157.4B音频token和320.5B文本token,经多阶段监督训练、文本Cascade...
从零开始玩转循环 (Getting started with loops)
最近大家都在热议“设计循环 (designing loops)”,而不是简单地给你的写代码的 AI 智能体 (AI Agent) 下提示词。如果你在 X(原 Twitter)上逛一逛,想搞清楚“循环”到底是个啥,你会看到五花八门的答案。
LingBot 2.0 执行倒水任务,体现 Moravec 悖论
机器人公司 Robbyant Brain 展示 LingBot 2.0 在家庭环境中自主完成开水龙头、装水瓶的简单动作。该任务虽对人类极易,却要求感知、力控与时序协同,正是 Moravec 悖论的现实例证。引用推文称其实现"完全自主运行",驱动技术将于明日揭晓。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2073915932939039036 via...
你的高质量token产出即将可计分
你为世界产生了多少高质量 token?我们很快就能计分了。 🔗 阅读原文:https://x.com/gabriel1/status/2073914975526044047 via AI HOT · https://aihot.virxact.com/items/cmr8furqd01p7sl0dck0kc6pg
Ethan Mollick:讨论中美AI竞争时应明确竞争基础
Ethan Mollick 指出,中美AI竞争的"游戏"本身存在多种理解,至少包括8种维度:企业盈利、科学成就与领导地位、商业模式(开源/闭源)、国家配套资产(芯片、电力、软件)销售、国家安全能力、控制前沿模型向盟友开放的战略、构建反映国家理想的AI"人格"以影响他国、以及率先实现ASI的竞速。此外可能还有更多。 🔗...
字节豆包、阿里千问宣布拟人化智能体 7 月 10 日下线
字节豆包之后,阿里千问宣布拟人化互动类智能体及用户自建智能体功能将于 2026 年 7 月 10 日正式下线(App 端显示智能体功能与服务于 7 月 15 日下线)。 🔗 阅读原文:https://www.ithome.com/0/972/874.htm via AI HOT · https://aihot.virxact.com/items/cmr8h2wlz020msl0dahdw7h9i
BestBlogs 07-06 早报精选
MCP apps 将 JSON 后端升级为 AI 客户端内的 iframe 交互界面;智能体持续学习需从生产日志推断模拟环境,并区分模型层、harness 层与记忆层的更新代价;Noi 集成插件调试揭示责任链断裂的方法论;sqlite-utils 4.0rc2 由 Claude Fable 及 GPT-5.5 编写,AI 成本约...
BestBlogs 早报:MCP apps 让客户端变产品入口,持续学习与 Noi 调试实录
本期早报聚焦 AI 产品从"可用"到"持续优化"的三大议题:MCP apps 将 AI 客户端(如 ChatGPT、Claude)从后端工具调用升级为交互式产品入口,服务器可返回沙箱化 iframe 组件并持续与模型通信,形成新的分发渠道;智能体持续学习需将生产日志转化为可重放、可回归的测试环境,改进应优先路由到记忆层或 harness 层,而非直接修改模型权重;Noi...
HBM 之父金正浩:AI 核心竞争力正从 GPU 转向内存,未来将演进至 3D 复合架构
韩国科学技术院教授金正浩近日称,AI 核心竞争力正从 GPU 转向内存。GPU 在推理中利用率仅 10%-30%,因每次计算需从 HBM 读写数据。未来技术包括:堆叠 NAND 闪存的 HBF(10 年后需求超 HBM)、采用 SRAM 的 HBS(容量可达 1600GB),以及由 HBM、HBF、HBS 组合的约 100 层 3D 复合架构。 🔗...
旧金山多辆 Waymo 自动驾驶出租车碾过烟花,其中一车起火
Waymo 正在调查旧金山独立日发生的几起事故。一辆无人驾驶车辆碾过路面小型烟花后被引燃,消防部门与当地人员到场扑灭明火,无人受伤。另有一辆自动驾驶车碾过非法燃放的烟花,未造成人员受伤或车辆受损,公司已联系乘客确认状况。受当日车流影响,部分 Waymo 运营服务出现中断,道路救援团队已将故障车辆撤离。Waymo 表示正在复盘事件并吸取经验,始终以保障乘客安全和赢得公众信任为首要目标。 🔗...
美国部分富人弃传统学校,年费7.5万美元送孩子上AI私塾
美国部分富人舍弃传统学校,转而依靠AI教育孩子。Forge Prep和Alpha School等机构向家庭收取数万美元学费,让孩子充当AI辅导工具的测试者。风险投资人肖恩·约翰逊计划送儿子就读年费7.5万美元(约51万元人民币)的Alpha School,称现行教育体系需要革新。Alpha...
Rohan Paul 今日 AI 动态汇总
字节跳动发布 EdgeBench 基准,评估 AI 智能体是否随经验提升;Mark Cuban 建议毕业生必须学 AI;论文研究人类与 LLM 研究想法差距;Harvard Business Review 称急于用 AI 会让公司更快做错事;当前 AI...
Phosphor数字学习平台:AI评分测验嵌入教学文本实现0.71-1.30标准差效果量
Phosphor平台将LLM评分的形成性测验嵌入教学文本,在达特茅斯学院三节统计导论课程中与151名学生部署。完成全部Phosphor内容与期末考试成绩提升0.71标准差(调整先前考试成绩后)至1.30标准差(未调整)相关。90.2%注册学生采用了这一完全可选、不计分的替代传统阅读方式,远超典型阅读完成率。嵌入式问答题(CRQ)由AI自动评分,与多项选择题混合呈现(40% CRQ,60%...
美国富人为孩子选择AI私校:每年数万美元充当未经验证技术的测试者
美国部分富裕家庭放弃传统学校,转向Forge Prep和Alpha School等机构提供的AI辅导和项目制工作坊,每年支付数万美元让孩子充当未经验证技术的beta测试者。硅谷风投者Shawn Johnson计划送孩子入读每年7.5万美元的Alpha Kindergarten,声称传统教育已失效。然而,这些学校不公开绩效指标,无法证明AI教育改善了学习成果;Alpha...
美团LongCat-2.0开源发布:1.6T MoE,1M上下文窗口
美团今日正式开源LongCat-2.0大模型,采用MIT许可证无限制开源。该模型为1.6T参数MoE架构,约48B活跃参数,支持1M token上下文窗口。原生集成Claude Code、OpenClaw和Hermes...
微软Fara1.5:9B设备端智能体网页导航性能翻倍
微软研究院AI Frontiers的Ahmed Awadallah独家访谈,介绍Fara1.5与MagenticBrain。9B参数的计算机使用模型在网页导航上性能近乎前代的两倍;27B版本可与Operator和Gemini 2.5 Computer Use匹敌。讨论为小模型构建智能体的权衡、何时应暂停询问用户,以及离在个人电脑上运行的智能体还有多远。 🔗...
日志即代理:ActiveGraph--事件溯源反应图实现可审计可分叉的智能体系统
ActiveGraph 是一个反转传统代理框架的运行时,将只追加的事件日志作为真相来源,工作图是日志的确定性投影。普通函数、类或 LLM 支持的例程等行为对图变化做出反应并发出新事件,组件间完全通过共享图协调,无需直接指令。该设计实现三个特性:从日志确定性重放任意运行、在任意事件低成本分叉运行且不重复共享前缀、以及从高层目标到单个模型调用的端到端溯源。项目以 Apache-2.0...
美团发布 LongCat-2.0:1.6T 参数开源 MoE 模型,原生支持 1M 上下文
美团发布 LongCat-2.0,1.6 万亿总参数、每 token 约激活 48B 的混合专家(MoE)模型,专为智能体编程设计。原生支持 1M token 上下文窗口,训练与推理全程运行于国产 AI ASIC 超算集群。架构含零计算专家、LongCat Sparse Attention、135B 参数 N-gram 嵌入及 MOPD 后训练。基准测试:SWE-bench Pro...