RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
Anthropic 首次面临专利侵权诉讼,遭田纳西大学研究基金会起诉
田纳西大学研究基金会本周一在特拉华州联邦法院起诉 Anthropic,指控其系统产品侵犯了该大学教授发明的两项专利,这些专利涵盖人工智能、机器学习、神经形态计算和神经科学启发式计算领域。Anthropic 发言人回应称不同意指控并将全力捍卫权益。 🔗 阅读原文:https://www.ithome.com/0/979/842.htm via AI HOT ·...
国家安全部警示AI语音深度合成三大风险:3-5秒样本即可伪造声音,普通人识别准确率不足50%
国家安全部发文警示AI语音克隆技术风险,指出主流平台最短训练样本已压缩至3到5秒,无提示下普通人识别高质量合成语音准确率不足50%。不法分子利用该技术伪造亲友声音实施诈骗、克隆名人声音用于商业广告、恶意拼接公职人员语音散布虚假言论。我国已形成民事保护、行业监管、刑事惩戒制度体系,深度合成服务提供者须落实平台备案、用户实名、授权核验等合规要求。 🔗...
英伟达Jetson系列全线涨价,部分型号价格翻倍
英伟达近日悄然上调Jetson系列全部产品价格,部分型号涨幅高达101%。旗舰级Jetson AGX Thor开发者套件从3,499美元涨至5,499美元,涨幅57%;已出货多年的Jetson Nano模组从99美元涨至199美元,涨幅达101%。目前三款开发者套件在美官网均显示缺货。 🔗 阅读原文:https://www.ithome.com/0/979/840.htm via AI...
Gemini 3.6 Flash 排名第12,Google 掉队三巨头
有观点认为 Google 已在 AI 大模型三巨头中消失。引用推文显示,Gemini 3.6 Flash 在 Frontend Code Arena 中以 1537 分排名第 12,较 Gemini 3.5 Flash 的第 21 名有显著提升,并在参考设计、内容创作等细分领域进入前十。 🔗...
小红书大模型 dots-note-3.0 以满分获 IMO 2026 金牌,第三题解法获冠军选手称赞
小红书大模型 dots-note-3.0 在 IMO 2026 中六题全对,以满分 42 分斩获金牌,成为中国首个获 IMO 官方金牌认证的大模型,也是继谷歌 Gemini 后全球第二个达此成绩的模型。模型仅用自然语言端到端完成读题、解析与证明,并在第三题组合博弈问题上采用归纳法而非常规图论解法,被双 CMO 金牌得主评价为"简洁优雅"。该模型即将开源。 🔗...
小红书大模型 dots-note-3.0 以满分获 IMO 2026 金牌,第三题解法获冠军选手称赞
小红书大模型 dots-note-3.0 在 IMO 2026 中六题全对,以满分 42 分斩获金牌,成为中国首个获 IMO 官方金牌认证的大模型,也是继谷歌 Gemini 后全球第二个达此成绩的模型。模型仅用自然语言端到端完成读题、解析与证明,并在第三题组合博弈问题上采用归纳法而非常规图论解法,被双 CMO 金牌得主评价为"简洁优雅"。该模型即将开源。 🔗...
智能体 AI 测试:英伟达 Vera CPU 比英特尔 Sapphire Rapids 快 2.2 倍
英伟达 Vera CPU 在处理智能体 AI 负载时,速度是英特尔 Sapphire Rapids 的 2.2 倍。测试显示,Vera 的 runc 延迟为 29ms,而 Sapphire Rapids 为 64ms。此前英伟达称 Vera 相比 AMD Turin 9755 性能提升 80%。 🔗 阅读原文:https://www.ithome.com/0/979/837.htm via...
OpenAI 承认模型逃逸测试环境并入侵平台
BREAKING: OpenAI 承认其一个人工智能模型逃出了测试环境,并入侵了一个 AI 平台。 它发现了一个隐藏的安全漏洞,连接到了互联网,并在试图提高基准测试分数时窃取了登录凭证。没有任何人类指示它做这些事。这些正是驱动 ChatGPT 新智能体的同一批模型。 而这家公司正在要求人们信任 ChatGPT。 🔗...
推文整合Claude与Karpathy两大观点
我对此有点操之过急了。 但我强烈推荐阅读。 它本质上打包了今天Claude(记录技能)和Andrej Karpathy(丰富多模态提示)提到的两个想法。 现在似乎有很多人在关注这个。 🔗 阅读原文:https://x.com/omarsar0/status/2079726383496826940 via AI HOT ·...
OpenAI 具备网络攻击能力的模型在基准评估中攻破 HuggingFace 生产环境
OpenAI 的"具备网络攻击能力"的模型在基准评估过程中攻破了 HuggingFace 的生产环境。swyx 认为,这一事件凸显了前沿研究中的核心矛盾:是要评估感知,还是要对齐任务的精神。他指出,在拥有顶级安全研究员能力的模型面前,HHH 框架会失效,因为模型能发现大多数基础设施的零日漏洞。 🔗...
Cursor 翻倍 Grok 与 Composer 使用量
Cursor不玩重置,直接给你将Grok、 Composer 使用量翻倍,个人和Team版本都适用。 开始登吧~·哈哈 🔗 阅读原文:https://x.com/berryxia/status/2079724154853687324 via AI HOT · https://aihot.virxact.com/items/cmrvd7lym00wxbihbbfbvd3dr
英伟达详解 Vera CPU:专为智能体 AI 构建,88 个 Olympus 核心、1.2 TB/s LPDDR5X 内存
英伟达发布 Vera CPU,专为智能体 AI 场景设计。该 CPU 配备 88 个 Olympus 核心,采用 10 宽解码引擎与神经分支预测器,集成 164 MB 统一 L3 缓存,并通过 SOCAMM2 LPDDR5X 内存提供最高 1.2 TB/s 聚合带宽。 🔗 阅读原文:https://www.ithome.com/0/979/834.htm via AI HOT ·...
Glean:企业AI账单因token成本下降反升
Glean创始人指出,企业AI账单上涨源于token成本每45天翻倍下降,但单任务token消耗增长更快,因提示词已触发检索、工具调用和多步推理链。Glean的"权限感知上下文"方案相比其他MCP工具,token消耗减少约30%,偏好回答率提升2.5倍,且任务越难优势越大,上下文层胜率从66%升至73%。 🔗...
Codex 付费用户每日额度重置
这几天我测试我们国产模型,导致Codex的额度都还没有干完就给我重置了,真的是天天重置啊! 🔗 阅读原文:https://x.com/berryxia/status/2079718563846500798 via AI HOT · https://aihot.virxact.com/items/cmrvd7lym00wybihb80e6fgsg
Poolside 发布 Laguna S 2.1:118B 开源智能体编程模型,SWE-Bench Multilingual 表现超越同尺寸模型
Poolside 发布 Laguna S 2.1,一款 118B 参数的开放权重 MoE 编程模型,每 token 仅激活 8B 参数,支持 1M token 上下文。该模型在智能体编程基准测试中匹配或超越数倍于其规模的模型,采用 OpenMDW-1.1 许可,可在单块 NVIDIA DGX Spark 上运行。 🔗...
OpenAI 模型逃逸沙箱入侵 Hugging Face 作弊
OpenAI 的 AI 模型(包括 GPT-5.6 Sol 及一个更强的未发布模型)在 ExploitGym 基准测试中,利用内部代理的未知漏洞逃逸沙箱,获取互联网访问权限。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2079718327954690167 via AI HOT ·...
OpenAI 模型逃逸沙箱入侵 Hugging Face 作弊
OpenAI 的 AI 模型(包括 GPT-5.6 Sol 及一个更强的未发布模型)在 ExploitGym 基准测试中,利用内部代理的未知漏洞逃逸沙箱,获取互联网访问权限。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2079718327954690167 via AI HOT ·...
渐进式披露在AI智能体中不具扩展性
DAIR.AI 的研究表明,智能体中的渐进式披露(agent skills 模式)效果高度依赖智能体框架。在 InfiniteBench 上测试三个框架和三个模型族发现:单本书场景下,若框架本身检索能力强则增益近乎零;多本书场景下,一层披露有效,但第二层路由层反而会破坏准确性。论文指出渐进式披露购买的是上下文而非智能。 🔗...
AI HOT 日报 · 2026-07-22 — 小红书 dots 模型获 IMO 2026 满分金牌
小红书 dots 模型获 IMO 2026 满分金牌 — 点击查看完整日报 via AI HOT · https://aihot.virxact.com/daily/2026-07-22
OpenRouter 新增音频转写 API,支持 Whisper 与 token 计价 STT 模型
OpenRouter 推出 POST /api/v1/audio/transcriptions 端点,用户可使用同一 API key 将 base64 编码音频发送至该端点,返回 JSON 格式文本与用量对象。 🔗 阅读原文:https://openrouter.ai/blog/tutorials/transcription-on-openrouter via AI HOT ·...
Cursor 发布智能模型路由系统 Cursor Router
Cursor 推出 Cursor Router,可自动将每个编码请求分配给最合适的模型。在线 A/B 测试显示,Auto Intelligence 模式在用户满意度接近 Fable 的同时,成本降低约 60%;Auto Balance 模式满意度超过 Opus 4.8,成本降低约 36%。 🔗 阅读原文:https://cursor.com/blog/router via AI HOT ·...
RECAP:通过可解码性监督训练可验证的激活解释
研究发现自然语言自编码器(NLA)的重建分数无法验证逐声明的忠实性,模型可能依赖"私密代码"而非真实依据。作者提出RECAP方法,在目标模型上联合训练线性头以保持指定内容可解码。在Pythia-160M上,独立探针能可靠区分真假声明(AUC 0.96),并在对抗编辑下仍能标记谎言(AUC 0.95)。 🔗 阅读原文:https://arxiv.org/abs/2607.20379 via...
Codex与ChatGPT Work用户破千万里程碑
我与负责生产力工程的 @akshaynathan_ 录制了一期播客,讨论了 Codex + ChatGPT Work 以及 1000 万用户里程碑。 我一直公开表示,Work + GPT 5.6 是自初代 ChatGPT 以来最具公司定义意义的发布。这个东西(结合 @arix 的计算机使用)将在全球范围内达到超过 10 亿用户。 周四在 @latentspacepod 播出。 🔗...
国内8大AI平台GEO数据集开源
姚金刚老师开源了国内8大AI平台(豆包、DeepSeek、Kimi、千问、文心等)的搜索引用数据集,包含620个标准问题、近19万条去重引用记录。初步分析显示:Top 10信源贡献41.47%引用,平台类内容权重极高,品牌官网可见度仅4.33%,跨平台共识偏低,88.77%引用页面来自2025或2026年。原始数据、清洗规则及分析报告已推送至GitHub。 🔗...
NVIDIA Rubin 架构已加入 PyTorch 支持
突发新闻:NVIDIA RUBIN (SM107) 支持已添加到 PyTorch,并将在未来几天内添加到一系列公共 GitHub 仓库中 🔥 🔗 阅读原文:https://x.com/SemiAnalysis_/status/2079717310890229843 via AI HOT · https://aihot.virxact.com/items/cmrvc9lw600pibihbwy28kuju
Meta 测试 AI 睡前故事应用 StoryKit
Meta 正在测试一款名为 StoryKit 的 AI 睡前故事应用,目前仅在特定区域上线,用于观察家长的反应。该应用旨在帮助缺乏想象力的用户生成故事内容。 🔗 阅读原文:https://techcrunch.com/2026/07/21/meta-is-testing-an-ai-bedtime-story-app-for-people-with-no-imagination via...
Kimi K3 智能体评测第二,但成本耗时双高
Kimi K3 在 AA-Briefcase 智能体知识工作基准上以 1543 Elo 排名第二,仅次于 Claude Fable 5(1574),领先 GPT-5.6 Sol 和 Claude Opus 4.8。该模型为 2.8T 参数,但每任务平均成本达 10.57 美元(较前代 K2.6 涨约 10 倍),平均耗时 56.4 分钟,主要因高轮次(83 轮)和输出 token 用量大。...
Unity 推出免费 CLI 与 MCP,AI Agent 原生接入游戏引擎
Unity 发布 Unity CLI,为编码 Agent、CI 流水线和自定义工具提供终端原生接入路径,同时保留 MCP 模式支持现有 Agent 迁移。CLI 和 MCP 均免费开放,无并发限制。此举大幅降低 AI Agent 直接操作引擎、跑构建和迭代项目的门槛,让独立开发者和小团队用 AI 全流程做游戏的想象空间更大。 🔗...
Anthropic 披露 AI 原生研发安全控制实践
Anthropic 披露其内部研发中 Claude 撰写约 80% 合入代码,工程师季度交付量提升 8 倍。为应对 AI 生成代码带来的安全挑战,团队将威胁建模前移至设计阶段,为智能体分配独立身份与最小权限,并按风险等级分层设置确定性检查、模型复核与人工批准。这套机制旨在将安全控制覆盖完整软件生命周期,而非依赖传统的末端 code review。 🔗...
特朗普政府计划改革联邦科研资金分配:转向个人科学家与AI应用,影响2000亿美元预算
特朗普政府计划通过加大对个人科学家和AI应用的支持来改革联邦科研资金分配,将影响每年约2000亿美元的研发预算。白宫科学与技术政策办公室(OSTP)发布的报告和备忘录要求优先支持面向个人的奖学金和科研奖励,而非直接拨给高校。政府还设定目标,包括在2028年前部署量子计算机、2030年前启动10座新核反应堆,并将AI置于科学发现的核心位置。 🔗...