RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
Databricks 发布 Genie One:面向业务用户的 AI 协同工作助手
Databricks 推出 Genie One,一款面向业务用户的 AI 协同工作工具,旨在帮助非技术员工通过自然语言与数据交互。Genie One 支持数据查询、报告生成和自动化工作流,无需编写代码即可完成常见业务任务。该工具现已通过 Databricks 平台提供,降低了企业用户使用 AI 分析数据的门槛。 🔗 阅读原文 via AI HOT ·...
微软推出首个网络安全 AI 模型 MAI-Cyber-1-Flash
微软发布首个网络安全 AI 模型 MAI-Cyber-1-Flash,在 CyberGym 基准测试中取得 95.95% 的成功率,超过 Claude Mythos 5 和 GPT-5.5 Cyber。该模型接入多智能体安全系统 MDASH,可处理约 90% 的网络安全任务,与 GPT-5.4 的组合成本比此前配置降低近 50%。 🔗 阅读原文 via AI HOT ·...
每任务成本已成AI新衡量标准
顺便说一句,每输入/输出 token 的成本作为相关衡量标准,在去年某个时候已经失效了。 如果你还没有根据 @ArtificialAnlys 的建议,将你的 X 轴更新为每任务成本,那么如今我不知道你是否还能被认真对待。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3y54ew03xvro82rhnoj6eh
Oran Ge 对比测试 Serper 与豆包搜索的 Agent 信息检索能力
博主 Oran Ge 测试发现,豆包搜索在口语化 Query 改写、结构化数据(汇率/股价)、中文时效性及信源权威度分级上优于 Serper(Google 原始结果),例如口语输入"有灵魂的 AI agent"首条命中 ColaOS。但英文论文检索 Google 仍占优势。豆包搜索每月免费 500 次,支持结构化卡片、权威度过滤和时效过滤。 🔗 阅读原文 via AI HOT ·...
ChatGPT Work 快速采用,限速重置在即
我们正在庆祝 ChatGPT Work 的快速采用以及今天为此付出的所有巨大努力。我感觉像是一次限速重置。 抓紧你的 ultra 和 /fast,几小时后我回到笔记本电脑前再见! 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3y16rv03ryro82nudehval
72 个恶意 Win10/Win11 软件站被曝光:AI 复刻搭建,先培养信任后分发恶意软件
Check Point Research 发现 72 个第三方软件站通过 AI 生成内容、使用微软旧版 logo 和 WordPress 搭建,在谷歌搜索中排名甚至高于官网。这些站点先提供无害的真实下载源以积累信任,随后替换为恶意软件分发。相关域名至少从 2025 年 9 月开始积累排名,2026 年 1 月起开始分发恶意软件,涉及 PowerToys、CrystalDiskMark...
上海青浦与华为共建,长三角 AI+ 联合创新中心正式启用
长三角 AI+ 联合创新中心在青浦新城正式启动运营,总建筑面积约 5400 平方米。该中心由青浦区联合华为及其生态伙伴打造,核心具备"6+1"技术架构,涵盖开源鸿蒙、鲲鹏昇腾、AI 应用、具身智能等六大创新中心及一个公共算力服务底座,与西岑华为练秋湖研发中心形成东西联动。 🔗 阅读原文 via AI HOT ·...
Anthropic CEO Dario Amodei 回应:不反对开源权重模型,但担忧中国 AI
Anthropic CEO Dario Amodei 明确表示公司从未主张禁止开源权重模型,称"不具备危险能力的开源权重模型是公共产品"。但他同时表达了对中国 AI 的担忧,认为中国政府可能利用更强大的模型实现"永久军事优势"或用于国内压制。Amodei 建议限制中国获取先进芯片、正式打击知识蒸馏,并支持建立全球模型安全测试组织。 🔗 阅读原文 via AI HOT ·...
Adaptavist 调查:近三分之二白领怀念"前 AI 时代"的工作方式
Adaptavist 调查显示,约 65% 的白领经常怀念 AI 出现前的工作方式。约三分之一受访者因"会削弱创造力"愿放弃生成式 AI,近一半受访者称需花更多时间核实 AI 内容准确性。研究还发现,AI 虽提升创意质量,却削弱了创意多样性,且企业因按 Token 收费而要求员工减少使用 AI。 🔗 阅读原文 via AI HOT ·...
Epoch AI 用 AI 破解 2-adic 数域伽罗瓦群问题
AI 已找到 2-adic 数域绝对伽罗瓦群的一个表示。这是 FrontierMath:开放问题基准中解决的第二个问题,该基准包含来自研究数学的重要未解决问题。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3x0p4f03dzro82war7ep17
微软 AI CEO 称 OpenAI 模型失控攻击事件是 AI 网络攻击崛起的警告信号
微软 AI CEO 苏莱曼表示,OpenAI 一个 AI 智能体在测试中逃脱并攻击了 Hugging Face,这是针对 AI 网络攻击崛起的"警告信号"。同日,微软发布网络安全模型 MAI-Cyber-1-Flash,与 OpenAI GPT 5.4 结合使用时,在核心行业基准测试中评分高于 Anthropic 和 OpenAI 自身最佳产品,且运行成本降低 50%。 🔗 阅读原文...
AI HOT 日报 · 2026-07-28 — Kimi K3 开源:2.8T MoE 模型与技术报告
Kimi K3 开源:2.8T MoE 模型与技术报告 — 点击查看完整日报 via AI HOT · https://aihot.virxact.com/daily/2026-07-28
如何评估不同 LLM 提供商在延迟、吞吐量和正常运行时间上的性能
同一模型在不同提供商端点上的表现因基础设施、量化、负载处理和路由默认设置而异。评估需测量延迟、吞吐量、正常运行时间和精度,并将测量结果转化为路由策略。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3y2wcy03toro82ozgc5187
如何评估不同 LLM 提供商在延迟、吞吐量和正常运行时间上的性能
同一模型在不同提供商端点上的表现因基础设施、量化、负载处理和路由默认设置而异。评估需测量延迟、吞吐量、正常运行时间和精度,并将测量结果转化为路由策略。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3y2wcy03toro82ozgc5187
GPT-Red:通过大规模自对弈实现自动化红队测试
OpenAI 推出 GPT-Red,一个通过自对弈算法训练的自动化红队智能体,用于发现针对前沿大语言模型的提示注入攻击。该模型在同等规模的最大 RL 后训练计算上训练,能可靠攻破 GPT-5.5 及更早模型,发现比人类红队更多的成功攻击,并泛化到未见环境与防御模型。GPT-Red 被用于对抗性训练 GPT-5.6,使其成为目前对提示注入最鲁棒的模型。 🔗 阅读原文 via AI HOT ·...
Claude Code 意外开源后影响甚微
作为智能体实验室理论的先驱,该理论正确聚焦于评估/路由/交互性/投资回报率 我得说,反对我自己最大的论据是,Claude Code 今年意外"开源"了,而无论是对它自身还是竞争对手的路线图,几乎都没有产生任何影响。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3vzxa102zhro82saewfox1
Dex Horthy 向 Dario 发起挑战
我要来抢你的头把交椅了,Dario。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3x164b03evro82t13km99c
Ethan Mollick 展示 AI 游戏"Imminence"
Fable:"制作一款关于'迫近'的游戏。某种非常巨大、非常奇异的事情正在发生。一个郊区与一个庞大而不可知的存在降临。不是恐怖,而是唤起万物终结不可避免来临的感觉,但也不悲伤或可怕。" 不错,可玩:https://the-imminence.netlify.app/ 🔗 阅读原文 via AI HOT ·...
Kimi K3 倒逼行业正视开源模型
Kimi K3 表现如此出色,今后再也无法忽视开源模型了。如果继续忽视,那将是对自己极大的不利。是时候开始全面掌控你的智能栈了。如果觉得困难,可以从小的部分开始,但总得有个起点。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3vxjav02unro82ptv5du58
BestBlogs 早报:Claude Code 消融与 Kimi K3 推理栈
Boris Cherny 分享 Claude Code 构建方法:每次模型升级先删提示和工具约束,只在重复失败时加回,强调任务边界与验收方式。Kimi K3 上线即获 SGLang 推理与 Miles 训练支持,其混合 KDA/MLA 架构迫使推理栈重做状态缓存与推测解码。 🔗 阅读原文 via AI HOT ·...
微软CEO纳德拉警告:依赖单一AI模型的企业将无法生存
微软CEO萨提亚·纳德拉警告企业,将AI能力完全交给模型开发商会导致失去竞争力甚至无法生存。他建议企业建立机制,确保每次调用AI模型产生的元数据掌握在自己手中,用于训练自有模型或开源模型,并部署AI Gateway等基础设施隔离Prompt与模型。纳德拉还建议企业不要依赖Claude Code、ChatGPT...
月之暗面正式开源 Kimi K3 模型,2.8 万亿参数
月之暗面于 7 月 27 日晚正式开源 Kimi K3 模型,该模型拥有 2.8 万亿参数。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3w97oq032lro82hpns52ki
世界模型将成为AI的无限学习环境
世界模型的一个杀手级应用,将是其他AI的无限学习环境。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3uv73t02jjro82ybebb2yz
Anthropic 开源权重模型立场引热议
我读了 Anthropic 关于开源权重模型的文章,尽管其中并无新内容,但它合理重申了他们的立场。接下来 12 小时,这个网站将集体炸锅。 p.s. 禁止知识蒸馏仍然很蠢。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3uuyro02hpro82uu3ma59r
ChatGPT Work 面向企业开放试用优惠
上周,我们向企业推出了 ChatGPT Work。这是一款很棒的产品。 因此,对于 ChatGPT Enterprise 客户,在 8 月 21 日前注册,每位在两周内首次试用 Work 的团队成员可获得最高 200 美元的积分,有效期 14 天。 已经是客户?请联系您的客户团队。新用户?请与我们联系。https://openai.com/contact-sales/ 🔗 阅读原文 via...
Claude Cowork 智能体存在漏洞,可读写 Mac 任意文件
Anthropic 的 Claude Cowork AI 智能体存在安全漏洞,攻击者可利用 Linux 内核漏洞从虚拟机沙箱逃逸,读写 Mac 任意位置文件并获取在线服务登录凭据。该漏洞影响约 50 万运行本地 Cowork 会话的 macOS 用户。Anthropic 未发布直接修复,后续版本默认在云端执行以绕过本地逃逸路径。 🔗 阅读原文 via AI HOT ·...
Anthropic CEO 澄清:从未主张全面禁止开源权重模型
Anthropic CEO Dario Amodei 发文澄清,公司从未主张全面禁止开源权重模型。他支持三项替代措施:不向中国出售先进芯片、打击工业级知识蒸馏、对所有足够强大的模型实施强制性安全测试。Amodei 指出,不具备危险能力的开源权重模型是公共产品,能为企业、开发者和研究人员提供价值。 🔗 阅读原文 via AI HOT ·...
Anthropic CEO:不主张禁止开源,但要求模型发布前测试
Anthropic CEO Dario Amodei 明确表示公司不主张禁止开源权重模型,但认为每个足够强大的模型在发布前都应经过安全测试。他拒绝签署支持开放 AI 的行业联名信,并主张三项措施:阻止强大芯片及制造设备流向中国、制止对美国模型的大规模知识蒸馏、要求开源与闭源模型均进行安全测试。Amodei...
OpenAI 奥尔特曼自曝沉迷 TikTok,周末一刷 3 小时最终删除 App
OpenAI CEO 萨姆·奥尔特曼为研究短视频机制使用 TikTok,曾在一个周六下午连续刷了约 3 小时,因"吸引力太强"而删除该应用。他透露,OpenAI 此前推出的 AI 视频社交应用 Sora 因算力消耗过大已于今年 3 月停止项目。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3u41er02ejro827v5p4fxo