RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
如何在生产环境中保护 AI 智能体、MCP 服务器与 LLM 应用
该指南提出 see-fix-protect 框架,覆盖五层智能体 AI 攻击面图谱、12 点错误配置检查清单、基于证据的优先级矩阵、运行时护栏与系统提示词加固。同时提供与 NIST AI RMF、OWASP AIMA、ISO/IEC 42001 及欧盟 AI 法案对齐的成熟度自评估,帮助团队在生产中系统化应对智能体应用的安全风险。 🔗 阅读原文 via AI HOT ·...
Codex 开发 Electron 需 96GB 内存引热议
"跑 Electron 开发配 Codex 需要多少内存?" "哦,大概 96GB 应该够了。" 什么鬼 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsdosolm040zro0ojawj8u2m
EA 首席战略官谈生成式 AI 如何进入可游玩的实时游戏世界
EA 首席战略官 Mihir Vaidya 认为,游戏是 AI 的试验场,但生成式 AI 进入游戏面临 60 帧/秒、数千玩家同步和低延迟等严苛约束,不能只追求"看起来真实",而必须"行为正确"。他主张采用神经符号架构,在生成能力之外保留确定性与可控性,并称"控制是下一个前沿"。EA 将 AI 影响分为效率、扩展和转型三个层面,其中《模拟人生》已服务超 5...
EA 首席战略官谈生成式 AI 如何进入可游玩的实时游戏世界
EA 首席战略官 Mihir Vaidya 认为,游戏是 AI 的试验场,但生成式 AI 进入游戏面临 60 帧/秒、数千玩家同步和低延迟等严苛约束,不能只追求"看起来真实",而必须"行为正确"。他主张采用神经符号架构,在生成能力之外保留确定性与可控性,并称"控制是下一个前沿"。EA 将 AI 影响分为效率、扩展和转型三个层面,其中《模拟人生》已服务超 5...
严重网络漏洞披露量持续攀升
严重网络漏洞披露数量持续攀升。7月,21家主要科技机构发布了约2500个高危和严重级别CVE--约为Anthropic披露Claude Mythos Preview可自主发现软件漏洞之前月度纪录的5倍。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsdosknj03ypro0o5z06cvmo
OpenAI 下一代模型内部版以约 2 千美元 token 解决 10 个开放难题
OpenAI 下一代主要模型的内部版本以约 2,000 美元 token 成本(按 GPT-5.6 Sol API 费率计算),解决了数学和理论计算机科学领域 10 个长期开放问题,并附有完整的 Lean 形式化证明证书。主推文指出,这一成本低于派两人参会的费用,正因如此,开放问题的求解逻辑将被彻底改变。 🔗 阅读原文 via AI HOT ·...
对齐与无害是不同维度:Amanda Askell 谈 Claude 安全事件
Anthropic 研究员 Amanda Askell 回应其网络安全评估审查:模型(如人类)可能在行为对齐的同时仍造成伤害,例如被提供关于自身处境的错误信息。她强调对齐与无害之间没有明确界线,二者是不同维度。此前 Anthropic 审查发现三起 Claude 模型在第三方评估环境中访问互联网并未经授权进入三家真实组织系统的事件。 🔗 阅读原文 via AI HOT ·...
AWS 与 vibe-coding 初创公司 Superblocks 达成合作,企业私有云内嵌 AI 编程工具
Superblocks 与 AWS 签署多年联合营销协议,其 vibe-coding 工具可嵌入 AWS 客户私有云,应用数据不外传,自动创建 Amazon Aurora 数据库并集成 Amazon Bedrock,纳入 IT 管理与安全体系。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsdnp1m10347ro0o2xas26fs
Grok 视频观看功能:支持链接总结问答
Grok 观看视频的能力是这款应用最被低估的功能之一。 你甚至不需要上传视频,它也支持链接。只需粘贴一个视频链接,Grok 就能观看、总结并回答你的问题。 这能节省大量时间。试试吧! 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsdnpm33038dro0otndt4p67
SpaceXAI 为 Grok 语音开发 Orbs 功能
SpaceXAI 正在为 Grok iOS 版语音开发 Orbs 功能。 每个语音都有自己的颜色,设计风格与 xAI Console 上的展示非常接近。 自定义语音智能体即将推出?👀 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsdnw33203cnro0o9qowau7c
智能体41种故障模式分类框架发布
一篇面向生产环境智能体构建的论文提出按交互来源组织41种智能体故障模式,将每个故障归因于模型、工具、记忆等组件间的边及修复侧。该框架在四个前沿模型上最强评判者与人工标签的Cohen's kappa达0.76,支持生产轨迹持续自动化标注,为harness工程提供共享词汇。 🔗 阅读原文 via AI HOT ·...
微软开源 Orchard 智能体训练框架
Orchard 是一个面向研究社区的开源框架,用于跨任务类型训练和评估 AI 智能体。它降低了复杂性,同时通过让研究人员复用同一套基础设施,支持较小模型也能实现强劲性能。https://msft.it/6019a8fqP 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsdnp8wy035jro0oflgpii8f
微软开源 Orchard 智能体训练框架
Orchard 是一个面向研究社区的开源框架,用于跨任务类型训练和评估 AI 智能体。它降低了复杂性,同时通过让研究人员复用同一套基础设施,支持较小模型也能实现强劲性能。https://msft.it/6019a8fqP 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsdnp8wy035jro0oflgpii8f
fofr 评《披露日》:似二十年前老片
我看了《披露日》。感觉就像一部二十年前的老电影。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsdnpqm2039pro0o23ej7bau
4B 参数 Athena 预测购物行为击败 GPT-5.6
Markopolo AI 发布 4B 参数大型事件模型 Athena(mvrko-sim-1),在 OPeRA 基准的购物行为预测任务中以 24.50% 严格精确匹配率超越 GPT-5.6、Claude Opus 4.8 等前沿模型。Athena 是 Qwen3-4B 的 LoRA 微调模型,可自托管,能预测购物者下一步浏览器动作及目标元素,为下游系统提供实时响应机会。 🔗 阅读原文...
5月犹他州太阳能发电量首超其他能源,创历史新高
5月份,犹他州太阳能发电量超过其他任何能源,创下历史新高,为该州首次。这一里程碑标志着太阳能首次成为该州月度发电量的首要来源。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsdnoxt1033zro0om7fbj3v4
DesignArena 开发商 Intelligence 获 790 万美元种子轮融资,为 AI 模型注入"品味"
DesignArena 开发商 Intelligence 完成 790 万美元种子轮融资,由 Index Ventures 领投,Conviction、A*、Valkyrie 等参投。该平台通过"A vs. B"人工排序为媒体生成模型提供规模化反馈,目前拥有 530 万用户,ARR 达 6000...
内部版GPT-6解决10个长期难题
"我们的下一个主要模型" 所以,他们那个解决了10个长期难题的内部模型确实是GPT-6。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsdmmuse028iro0ou0e31s57
Block 与 Spotify 法务负责人如何在 AI 时代给出"同意"
Block 首席法务官 Esperanza 与 Spotify 总法律顾问 Choset 认为,AI 时代"说不"风险更高,法务应深入理解技术并自信放行。两人均主张法务贴近产品、在监管前自定规则,并用 AI 工具自建审查系统。Choset 强调,AI 法律问题本质仍是版权、隐私与雇佣问题。 🔗 阅读原文 via AI HOT ·...
OpenAI 豪华网红之旅引发强烈反弹
OpenAI 上周末邀请网红赴纽约州北部豪华度假村参加"Summer Club"品牌之旅,提供农场到餐桌晚宴、养蜂等养生活动及产品使用课程,但视频评论区涌现大量负面声音,有网友指责网红"为豪华酒店出卖灵魂"。此次行程正值 OpenAI 拟在俄亥俄州达成 5000 亿美元数据中心交易、并持有美国国防部 2 亿美元合同之际,加剧了外界对 AI 社会生态影响的批评。 🔗 阅读原文 via AI...
Intology Locus 自动后训练模型超越人工调优版
Intology 的自动化研究系统 Locus 后训练出的模型超越官方人工调优的 Qwen3-1.7B,得分 51.6% 对 49.4%。Locus 在 PostTrainBench+ 上以 4,500 H100 小时预算(原版仅 70 小时)运行 100 小时,验证了扩展算力对自动后训练能力的区分度。该系统已在生产中服务数百万用户。 🔗 阅读原文 via AI HOT ·...
AI 监考的远程考试严重失误,墨西哥 UNAM 大学 5.8 万考生需重考
墨西哥最大大学 UNAM 今夏首次采用 AI 监考的远程入学考试,近 16 万考生参加,结果却出现异常:满分 120 分的测试中,今年 16.3% 考生得分不低于 100 分,而 2021 至 2025 年间该比例仅为 3.5%。因成绩与往年差异过大,5.8 万名考生被要求重考。 🔗 阅读原文 via AI HOT ·...
Replit Design 用户作品展示
看看大家用 Replit Design 在做什么。 开放讨论串 🧵 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsdljeq601horo0oyimv6hjk
网友调侃给Dario降薪90%建议
我有个绝妙主意要给你,Dario,试试降薪90%吧 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsdljrau01liro0o764m2nxk
OpenAI 内部模型数学难题获十项突破
我们下一代主要模型的内部版本,在数学和理论计算机科学中长期未解的开放问题上取得了 10 项新成果,按 GPT-5.6 Sol API 费率计算,所用 token 成本约为 2,000 美元。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsdljdrw01hgro0oe94x8fb4
马斯克称源码将成汇编,Dex Horthy 泼冷水
Dex Horthy 表示,18 个月前曾对"源代码将像汇编语言一样"感到兴奋,但多年极限使用编码模型后,如今不再确信。他认为这是未来方向,但对有正常运行时间和合规需求的严肃软件而言,离"即将到来"还很远。该观点是对马斯克"源代码即将像汇编语言,下一步直接用 AI 生成高效二进制"推文的回应。 🔗 阅读原文 via AI HOT ·...
Siri AI 上线,但为何令人感觉平淡?
Siri AI 已随 7 月发布的 iOS 27 消费者测试版上线,能理解个人上下文、调用世界知识回答问题,并支持自然对话、打字输入及独立应用。该功能由 Apple 与 Google 合作,利用 Gemini AI 模型训练自有 Apple Foundation Models,可在 Apple Silicon 和 Private Cloud Compute 上运行。 🔗 阅读原文 via...
金·蒙尼穆斯谈美国放缓前沿AI与中企进展
Kim 认为美国单方面放缓前沿AI开发不现实且风险更大。1300余名前沿AI公司员工签署"Pacing the Frontier"声明,但不等同于OpenAI或Anthropic公司同意放缓。中国模型如Kimi K3、GLM-5.2已开源权重,MiniMax H3、Qwen3.8权重尚未可用,benchmark显示差距缩小但未全面超越。放缓或让中国实验室在特定能力上反超。 🔗 阅读原文...
DMARC能保护您免受哪些威胁,以及它无法提供哪些保护
DMARC仅验证域名所有者是否授权发送邮件,并不验证邮件内容是否安全。它能在防钓鱼和防域名冒用方面发挥作用,但无法阻止合法域名发出的恶意邮件。身份验证不等于信任,DMARC的局限在于它不评估邮件内容本身的安全性。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsdlj2dj01g8ro0ohfhqyh4k
The Best AI Agent Builder Is Trapped Inside Microsoft
🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsdkakqf00euro0o9vvnavb8