RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
豆包实时语音模型3.0 API上线,支持自定义工具
豆包实时语音模型3.0 API正式上线。支持全双工(同时听和说,可随时插话)和端到端(语音进、语音出,无转录),交互更快速自然。具备精准遵循指令能力,如设定"先不出声,聊到世界杯再加入"后安静待命。关键升级是支持自定义工具,可在实时对话中直接调用工具完成任务(预定日历、发邮件、总结文档、发起查询等),从"语音助手"向"语音 Agent"迈进。
管理者使用Claude Code编码成功率最高
一些(初步)证据表明,管理者在使用Claude Code进行编码时成功率最高。 我一直认为管理是AI的超级能力,因为明确说明你想要什么、如何做以及什么样子算好,是使用智能体的关键。https://www.oneusefulthing.org/p/management-as-ai-superpower
我们在 Elasticsearch 上构建了一个持久化代理内存层,其召回率为0.89
Agent Builder 正式上市(GA)。基于 Elasticsearch 的持久化内存层将记忆分为情景、语义、程序三类,分别存入独立索引,各设不同写速率与过期规则。召回采用 BM25 与 Jina v5 稠密向量的 RRF 融合,再经交叉编码器重排序。在 168 道 QA 题评估中,R@10 平均 0.89,零跨租户泄漏。该层可通过支持 MCP...
我们在 Elasticsearch 上构建了一个持久化代理内存层,其召回率为0.89
Agent Builder 正式上市(GA)。基于 Elasticsearch 的持久化内存层将记忆分为情景、语义、程序三类,分别存入独立索引,各设不同写速率与过期规则。召回采用 BM25 与 Jina v5 稠密向量的 RRF 融合,再经交叉编码器重排序。在 168 道 QA 题评估中,R@10 平均 0.89,零跨租户泄漏。该层可通过支持 MCP...
Codex 推出 Record & Replay 功能:演示一次操作即可自动复用
Codex 推出 Record & Replay 功能,用户可在电脑上演示一次操作流程,Codex 观察并自动生成可复用的 Skill。下次遇到同类任务,Codex 即可自动执行。官方以"发 YouTube 视频"演示:手动走完拉元数据、配缩略图和字幕、上传存为私密、核对等流程,新对话中 Codex...
OpenAI 企业 AI 销售主管 Barret Zoph 重返五个月后再离职
OpenAI 企业 AI 销售主管 Barret Zoph 在重返公司仅五个月后再次离职。他于今年 1 月中旬回归,此前是 Mira Murati 创办的 Thinking Machines Lab 联合创始人兼 CTO。Zoph 最初于 2024 年秋离开 OpenAI 加入该实验室,但在 2026 年 1 月因涉及与同事未公开关系的不当行为指控而突然离职。OpenAI 确认了 Zoph...
阿里开源向量数据库Zvec,UCSD黄碧薇教授提出因果AI第四代范式
阿里开源内部向量数据库Zvec,pip install zvec免费使用,对标Pinecone每月70美元能力。支持十亿向量毫秒级检索,无需单独起服务,全平台兼容;v0.5.0新增原生全文混合搜索。UCSD黄碧薇教授(causal-learn作者)提出AI四代范式:相关性小模型→因果小模型→相关性大模型(LLM)→因果大模型,认为当前正站在第四代门口。其创立的Aether...
阿里开源向量数据库Zvec,UCSD黄碧薇教授提出因果AI第四代范式
阿里开源内部向量数据库Zvec,pip install zvec免费使用,对标Pinecone每月70美元能力。支持十亿向量毫秒级检索,无需单独起服务,全平台兼容;v0.5.0新增原生全文混合搜索。UCSD黄碧薇教授(causal-learn作者)提出AI四代范式:相关性小模型→因果小模型→相关性大模型(LLM)→因果大模型,认为当前正站在第四代门口。其创立的Aether...
Jason Liu 公布 Codex 团队列表
Codex 团队列表 抢先说:别私信我说我没在列表上 https://x.com/i/lists/2067819170989854863?s=20
Peter Steinberger 评 Codex Record & ReplayTM️:一切皆快或慢 API
Peter Steinberger 引用 @nickbaumann_ 介绍 Codex Record & ReplayTM️ 新原语:让 Codex 观看用户电脑操作,通过录制和事件(与 computer use 同框架)理解操作,转化为未来可复用的技能。使用案例:按个人风格格式化日历邀请(GCal 插件)、起草 PR 并分享到指定 Slack...
DeepSeek研究员开源AutoResearch:AI自主跑通285B模型RL研究闭环
DeepSeek研究员Deli Chen将AutoResearch协议开源,并发布Self-play综述论文。其AI智能体首次完全自主地在DeepSeek 285B模型上完成完整RL研究闭环--从实验设计、写代码、提交GPU任务、debug到结论总结,全程零人工干预。系统调用了GRPO工具,被视为持续学习研究的开端。
DeepSeek研究员开源AutoResearch:AI自主跑通285B模型RL研究闭环
DeepSeek研究员Deli Chen将AutoResearch协议开源,并发布Self-play综述论文。其AI智能体首次完全自主地在DeepSeek 285B模型上完成完整RL研究闭环--从实验设计、写代码、提交GPU任务、debug到结论总结,全程零人工干预。系统调用了GRPO工具,被视为持续学习研究的开端。
《道德经》AI配图版开源,Seedream 5生图
一个将《道德经》每句拆解翻译成大白话并配以AI生图的漫画项目已开源,在线体验和GitHub仓库已公开。生图基于Seedream 5模型,目前效果尚有优化空间(图文相关性不够稳定),但整体阅读体验有所提升。
Codex MCP集成Claude Code和多模型协作开源
开发者在Codex基础上开发了一个MCP,支持在Codex中调用Claude Code(用于写作等场景用Claude Sonnet 4.6,前端网页用Claude 4.8),并可随时调用国产廉价模型如智谱GLM-5.2、Deepseek V4 Flash用于开发、翻译等。该MCP还支持多模型多轮讨论,由Codex汇总方案。项目已免费开源。
Fable模型被美国临时关闭,AI安全管控时代来临
美国政府短暂关闭了Mythos类中的Fable模型,标志着AI模型已越过危险门槛。作者预测最多两三代模型后,超级智能将像核武器一样被管控,大多数Fortune 500企业无法访问或仅受控使用。开源模型落后前沿约七个月,且面临算力和政府锁定的双重壁垒。人类的"辨别地平线"使许多人感觉模型进步停止,但实际指数增长未停--只是用户缺少足够困难的问题。Fable类已能解决此前Opus...
Fable模型被美国临时关闭,AI安全管控时代来临
美国政府短暂关闭了Mythos类中的Fable模型,标志着AI模型已越过危险门槛。作者预测最多两三代模型后,超级智能将像核武器一样被管控,大多数Fortune 500企业无法访问或仅受控使用。开源模型落后前沿约七个月,且面临算力和政府锁定的双重壁垒。人类的"辨别地平线"使许多人感觉模型进步停止,但实际指数增长未停--只是用户缺少足够困难的问题。Fable类已能解决此前Opus...
蔡崇信:阿里全面投入 AI,开源的主要推动力量来自中国企业
蔡崇信昨日在 VivaTech 2026 上表示,AI 的总潜在市场规模达 50 万亿美元,对标人类生产力,阿里巴巴正全面投入 AI。其全栈 AI 优势包括:中国高效低成本的能源供给,提前布局的云计算和芯片,全球最受欢迎的开源模型千问(Qwen),以及覆盖电商、即时零售等丰富应用场景。他同时指出,当前全球 AI 开源的主要推动力量来自中国企业,阿里巴巴团队在推动前沿模型开源方面做出巨大贡献。
GLM-5.2 移动开发长程任务性能翻倍
智谱 GLM-5.2 在内部 35 项挑战性移动开发任务(共 70 次试验)中完成率达 48/70,较 GLM-5.1 的 21/70 提升超两倍;同期 Claude Fable 5 为 56/70。主推文指出长程能力应落地真实场景,更多场景即将推出。
有益RL数据可提升模型广泛对齐能力
研究表明,用"邪恶"数据训练AI会导致普遍的不对齐;而使用少量有益特质数据(即使仅限健康领域)进行强化学习,也能显著提升模型在广泛的对齐和益处评估上的表现。该研究希望推动更广泛、更持久的有益模型发展。
Claude Code 使用限制显示错误已修复
今天早些时候,约3%的Claude Code Max和Pro用户遇到了一个bug,显示错误的每周使用限制,并在某些情况下阻止他们发送消息。此问题已修复,我们正在重置所有受影响用户的5小时和每周限制。对此造成的不便深表歉意。
今天在香港,习惯性打开 ChatGPT,才意识到在香港不能用 😂 想想也挺有意思,在大陆和香港都不能用,但原因还不太一样 一个是有人替我们拒绝了 OpenAI,一个是 OpenAI 拒绝了他们
今天在香港,习惯性打开 ChatGPT,才意识到在香港不能用 😂 想想也挺有意思,在大陆和香港都不能用,但原因还不太一样 一个是有人替我们拒绝了 OpenAI,一个是 OpenAI 拒绝了他们
谷歌与Refik Anadol打造全球首个AI艺术博物馆Dataland
谷歌携手艺术家Refik Anadol,在洛杉矶打造全球首个AI艺术博物馆Dataland,将于6月20日开馆。博物馆面积约2500平方米,开幕展"Machine Dreams: Rainforest"由Large Nature Model驱动。利用Google Cloud的Gemini Enterprise Agent Platform和Compute...
MCP 零接触 OAuth:Enterprise-Managed Authorization 扩展现已稳定
Enterprise-Managed Authorization (EMA) 扩展现已稳定。该扩展允许组织通过受信任的身份提供商(如 Okta)集中控制 MCP 服务器的访问权限。终端用户首次登录即可自动连接所有已授权的 MCP 服务器,无需逐个执行 OAuth 授权。Anthropic 已在 Claude、Claude Code 和 Cowork 中实现该扩展,Visual Studio...
Peter Thiel领投1.4亿美元押注海上AI数据中心,Aether AI获首轮融资推因果大模型
Peter Thiel领投1.4亿美元B轮,押注完全离网的海上AI数据中心。第三代浮动节点Ocean-3单节点1MW,靠海浪发电、海水冷却、低轨卫星回传,无需征地接电网。首台试点预计今年8月在北太平洋下水,规模化商用至少等到2027年。同时,Aether AI官宣首轮融资,UCSD黄碧薇教授推出因果AI,将AI分为相关性小模型、因果小模型、LLM、因果大模型四代,旨在从视频中自动提取物理规律。
Grok&Word插件现身Office,国内WPS用户多?
Grok & Word 插件在 Office 里面也可以起飞了😂 不过国内用 wps 的人感觉比 Office 多啊,尤其很多人估计还是盗版吧…
TesterArmy (YC P26) - 用于测试网页和移动应用的代理程序
TesterArmy 是一个 AI 代理程序,持续监控网站和移动应用的关键用户流程,并在出现问题时向团队发出警报。只需粘贴 URL 即可创建项目,无需 SDK、测试脚本或基础设施维护。用户用自然语言描述测试场景,AI 代理自动导航页面、填写表单、处理 OAuth 和 OTP 登录流程。支持通过 GitHub App 自动 PR 检查、定时运行生产监控或通过 webhook...