RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
GLM 5.2 持续获胜
Kim指出,GLM 5.2是首个能以开放权重处理真实自动研究任务的模型,包括调试设置、跨多节点H100集群运行并比较RL训练实验。其局限在于缺少图像理解能力,需程序化分析原始WandB数据而非可视化图表。引用介绍称,GLM 5.2是其自动研究pipeline上首个能胜任实际研究的开源模型,在Fable...
opencode推出独立用户排名
我们已添加独立用户排名 某些模型 token 消耗大,导致它们在排名中偏高--使用模型的独立用户数是更准确的排名 我们将围绕这一指标调整更多数据 🔗 阅读原文:https://x.com/opencode/status/2069140423197479225
美国机器人公司无法获取所需硬件
这种做法将意味着美国机器人公司无法获得研发所需的硬件。 🔗 阅读原文:https://x.com/SemiAnalysis_/status/2069140417442873760
Sakana Fugu Ultra发布,性能匹配Fable和Mythos
Sakana AI 推出 Fugu 多智能体编排系统,通过单个模型 API 即可访问。其 'Fugu Ultra' 模型性能匹配 Fable 和 Mythos,提供前沿能力且无出口管制风险。在生成程序化地形(Three.js)的对比中,Fugu Ultra 在一次生成(one-shotted)下表现突出。更多示例即将分享。 🔗...
AI 治理清单:LLM 架构先行
Deloitte 报告显示企业 AI 抱负与治理成熟度之间差 53 个百分点,74% 计划两年内部署智能体 AI,仅 21% 拥有成熟治理模型。路由架构是首个治理层。三种姿态--托管网关(如 OpenRouter、Portkey)、自托管网关(如 LiteLLM)和直接 API--默认治理能力不同,直接 API...
NotebookLM 闪卡支持完全自定义与分享
Flashcards 现已完全可自定义。编辑问题、调整答案、添加新卡片,打造终极学习工具集。 与朋友、同学、学术竞争对手等分享--只需准备好迎接随之而来的无尽赞美与赞誉。 🔗 阅读原文:https://x.com/NotebookLM/status/2069132913866953098
OpenAI推出Patch the Planet安全修复计划
Patch the Planet 是 OpenAI 帮助开源维护者从安全发现到合并修复的努力。他们与 Trail of Bits、HackerOne、Calif、研究人员及维护者合作,将 Codex Security 和先进模型引入修复流程,并以人工审查为核心。 🔗 阅读原文:https://x.com/steipete/status/2069132838356840857
Google DeepMind 7500 万美元投资 A24,合作开发电影 AI 工具
Google DeepMind 宣布向独立电影制片厂 A24 投资 7500 万美元(据《华尔街日报》),双方将合作开发电影制作 AI 工具。A24 出品过《万事俱备》《后室》等影片。Google DeepMind CEO Demis Hassabis 称,希望通过与艺术家直接合作,打造支持创意表达的 AI 功能。此举是好莱坞最新一次科技公司与电影 AI 联手,此前 Netflix 已收购...
Google DeepMind 7500 万美元投资 A24,合作开发电影 AI 工具
Google DeepMind 宣布向独立电影制片厂 A24 投资 7500 万美元(据《华尔街日报》),双方将合作开发电影制作 AI 工具。A24 出品过《万事俱备》《后室》等影片。Google DeepMind CEO Demis Hassabis 称,希望通过与艺术家直接合作,打造支持创意表达的 AI 功能。此举是好莱坞最新一次科技公司与电影 AI 联手,此前 Netflix 已收购...
Sakana AI 发布多智能体编排系统 Sakana Fugu,对外表现为单一模型
今日 Sakana AI 发布 Sakana Fugu,一个多智能体编排系统,对外表现为单一模型。用户通过 OpenAI 兼容端点发送请求,Fugu 内部决定直接求解或组建专家模型团队协作。提供两个变体:Fugu(平衡性能与低延迟,支持特定 agent opt-out)和 Fugu Ultra(针对困难多步问题优化,固定 agent 池,当前模型 ID 为...
Codex Security 插件:深度扫描与威胁建模
面向安全团队的 Codex Security 插件:深度扫描、验证发现、追踪攻击路径、构建威胁模型、生成针对代码库的补丁以供审查,以及导出到其他工具:https://openai.com/daybreak/codex-security-plugin/ 🔗 阅读原文:https://x.com/gdb/status/2069128701850386834
不要用AI代写署名作品
作者明确表示绝不让AI起草任何署自己名字的句子。他以亲身经历说明,用AI代写并声称是自己的作品等同于说谎--正如他曾为他人代笔发表文章,至今仍感后悔。他强调,与AI深度协作写内容时,旁人无法核实你实际贡献了多少,因此所有"AI帮助写作"的声明都会让人怀疑作品真实性。作者警告,一旦使用AI代写并冒充原创,专业人士会将其作品视为垃圾信息,个人信誉将毁于一旦。他呼吁读者不要在署名作品中使用AI代写...
SaaS空头竟信Claude能一键生成所有软件
这似乎愚蠢得令人难以置信,但显然SaaS空头的真实信念是"所有软件都是0,因为Claude可以一次性生成这些应用" 这种说法简直是惊人的短视。 🔗 阅读原文:https://x.com/fchollet/status/2069122975371284708
GLM-5.2 在 GDPval-AA 基准排名第三,领先开源权重模型
智谱 AI 的 GLM-5.2 在真实世界智能体工作基准 GDPval-AA 上获得 1524 Elo,排名第三,仅次于 Claude Fable 5 和 Claude Opus 4.8,与 GPT-5.5 持平。它是开源权重模型中领先的,超越 Gemini 3.5 Flash、Qwen 3.7 Max 等专有模型。任务为智能体型,平均每任务约 31 轮。此外,GLM-5.2 在...
GPT-5.5-Cyber完整版发布,安全工具上线
我们希望帮助所有公司变得安全,与美国政府和安全生态系统合作。 *GPT-5.5-Cyber完整版已发布;在CyberGym上达到最先进性能。 *Patch The Planet 和 Codex Security 将帮助解决安全问题,而不仅仅是发现它们。 🔗 阅读原文:https://x.com/sama/status/2069121360744550796
Google 将 Interactions API 作为 Gemini 模型与智能体的默认接口
Google DeepMind 宣布 Interactions API 正式可用,成为 Gemini 模型和智能体的默认接口。该 API 自 2025 年 12 月进入 Beta 测试,现取代 Google AI Studio 和文档中的旧 generateContent 接口;未来新智能体功能仅通过它提供。近期新增功能包括:自带 Linux 沙箱的 Managed...
OpenAI Daybreak 更新:Codex 安全插件 + GPT-5.5-Cyber 实现漏洞自动修复
OpenAI Daybreak 计划更新,推出 Codex 安全插件和专属 GPT-5.5-Cyber 模型,实现从漏洞发现到补丁生成的自动闭环,将以往数周乃至数月的修复时间压缩至数小时。该模型已为 Linux 内核、FreeBSD、cURL、Go、Python、Sigstore、pyca/cryptography 等关键项目发现并生成补丁。GPT-5.5-Cyber...
Bland语音AI:周通话350万+,累计5.13亿,获1亿美元C轮融资
语音AI平台Bland (@usebland) 每周处理超过350万次电话,累计已处理超5.13亿次。公司获得1亿美元C轮融资,将用于训练模型以处理紧急、高风险、长达45分钟的电话呼叫。Bland专注于受监管行业,主打高压力、后果严重的电话场景。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2069118054798418156
预测机器自指产生方向错觉
镜子对着镜子创造深度的错觉。预测机器指向自身创造方向的错觉。 🔗 阅读原文:https://x.com/fchollet/status/2069116822910366137
Google Interactions API 正式发布
今天我们将 Interactions API 推向 GA,这是我们设计的新 API,可让您在同一个界面中编排跨模型和智能体,并将成为我们未来的默认 API。Interactions 为智能体新时代奠定了基础。 🔗 阅读原文:https://x.com/OfficialLoganK/status/2069115284519346263
宾大教授实测Sakana Fugu Ultra-high:速度极慢,效果仅"fine"未达官方宣称水平
宾大教授Ethan Mollick实测Sakana Fugu Ultra-high模型,指出其速度极慢--典型编码测试需30分钟,实际效果仅"fine",未能匹配此前Sakana官方宣称的"与Fable和Mythos性能相当"。Mollick表示,在真实编码场景中Fugu Ultra远不及Fable,并附上AI港口小镇生成样例链接作为例证。 🔗...
OpenAI Daybreak:加速漏洞修复,推出新工具与模型
Greg Brockman 宣布 OpenAI Daybreak 加速漏洞发现与修复。模型已能发现并生成针对主流浏览器、网络基础设施、FreeBSD 和 Linux 内核等操作系统,以及 cURL、Go、Python、Sigstore、pyca/cryptography 等项目的关键漏洞补丁。同时扩展 Daybreak 项目:推出 Codex Security 插件(在 Codex...
OpenAI 扩展 Daybreak 项目,发布 GPT-5.5-Cyber 等安全工具
OpenAI 宣布扩展 Daybreak 项目,旨在以机器速度民主化修复脆弱软件。主要发布包括:Codex Security 插件(在 Codex 内发现、验证并修复漏洞);完整版 GPT-5.5-Cyber 模型(面向受信防御者的安全专用模型);Cyber Partner Program(支持安全公司基于 OpenAI 顶级网络能力构建产品);以及 Patch the...
亚马逊在印度测试支持印地语的 Alexa+
亚马逊正将生成式AI对话助手Alexa+扩展至印度,邀请用户参与印地语版Beta测试。测试版可能存在Bug,或提供不准确信息及误发音本地用语。Alexa+尚未在印度上线,具体时间未定。亚马逊于2017年在印度推出英语版Alexa,2019年加入印地语支持。Alexa+于2025年发布,今年2月向所有美国用户开放,随后扩展至英国、加拿大等国。Prime会员免费,其他用户付费。 🔗...
Reflection通过SpaceX获Nvidia GB300芯片
SpaceX(xAI)正在成为下一个 Oracle。 据报道,Reflection 通过 SpaceX 获得了 Nvidia GB300 芯片的即时使用权,并将从 2026 年 7 月 1 日起每月支付 1.5 亿美元。 如果该交易持续到 2029 年,总价值将达到约 63 亿美元。 🔗 阅读原文:https://x.com/kimmonismus/status/2069110208563990667
Google Interactions API 正式可用:统一端点、稳定 schema、Managed Agents 等新功能
Google Interactions API 现已正式可用(GA),通过统一 `/interactions` 端点提供稳定 schema,同时支持模型推理与自主智能体。关键更新包括:Managed Agents - 单次 API 调用即可启动安全远程 Linux 沙箱进行代码执行与网页浏览,默认使用 `antigravity-preview-05-2026` 智能体或自定义指令;简化...
Claude Fable 5总结AI生图性感人像提示词8大写法
用户通过Claude Fable 5总结出AI生成性感人像提示词的8种有效写法:用"成人+气质+材质"定人设;用"服装剪裁+面料质感"替代直白身体描述;用"表情瞬间"制造吸引力;用"镜头语言"强化质感;用"光线"塑造皮肤轮廓;用"背景虚化+前景留白"凸显主体;用"克制的性感"而非夸张;用强负面词避免跑偏。此外还需使用干净住宅IP以避免风控拒绝。 🔗...
Anthropic与Micron计划共同设计AI内存架构
Anthropic与Micron达成AI基础设施协议,包括四部分:共同设计AI内存架构、Micron多年期数据中心产品供货合同、在Micron内部署Claude、以及Micron参与Anthropic H轮融资。双方将研究不同AI负载下的内存系统行为,以提升性能与能效;Micron将供应HBM、DRAM和SSD。Anthropic联合创始人Tom...
Reflection AI获SpaceX 63亿美元计算交易训练开源模型
SpaceX与Reflection AI签署63亿美元计算协议,Reflection将立即获得GB300芯片用于训练开源模型,并于2026年7月1日起每月支付1.5亿美元至2029年。Emad Mostaque(前Stability AI CEO)称该计算量可能相当于所有中国开源公司(使用更先进芯片)之和,并询问是否有市场预测Reflection AI何时发布首个模型。 🔗...