RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
Gemini 3.5 Flash 中的计算机使用
Google 将计算机使用(Computer use)作为内置工具集成至 Gemini 3.5 Flash,使开发者能构建跨浏览器、移动端和桌面环境的智能体。此前该功能仅作为独立模型在 Gemini 2.5 中提供,现已原生整合至主 Flash 模型。开发者可通过 Gemini API 及 Gemini Enterprise Agent Platform...
Gemini 3.5 Flash 中的计算机使用
Google 将计算机使用(Computer use)作为内置工具集成至 Gemini 3.5 Flash,使开发者能构建跨浏览器、移动端和桌面环境的智能体。此前该功能仅作为独立模型在 Gemini 2.5 中提供,现已原生整合至主 Flash 模型。开发者可通过 Gemini API 及 Gemini Enterprise Agent Platform...
Notion 使用 Cursor SDK 嵌入编码智能体
Notion 通过 Cursor SDK 在数周内将编码智能体嵌入产品。用户可在文档中@Cursor、在讨论串中提及或向数据库指派任务,Cursor 即可端到端完成规划、构建、测试、验证并自动创建 PR。集成基于一套 Provider 无关的智能体框架,Notion 的讨论串对应一个 Cursor 智能体,每条消息对应一次智能体运行;结果通过 SSE 流式传输,支持断连恢复。Cursor...
Notion 使用 Cursor SDK 嵌入编码智能体
Notion 通过 Cursor SDK 在数周内将编码智能体嵌入产品。用户可在文档中@Cursor、在讨论串中提及或向数据库指派任务,Cursor 即可端到端完成规划、构建、测试、验证并自动创建 PR。集成基于一套 Provider 无关的智能体框架,Notion 的讨论串对应一个 Cursor 智能体,每条消息对应一次智能体运行;结果通过 SSE 流式传输,支持断连恢复。Cursor...
GLM-5.2 魔改版让 vLLM 支持推测性解码,速度飙升至 43 token/s
GLM-5.2 自带 MTP(推测性解码)头因采用 DSA(动态稀疏注意力),导致 vLLM、llama.cpp、mlx 等推理引擎难以支持。原始 bf16 精度需 1.5TB,4bit 量化仅 430GB。社区作者 dnhkng 制作了 GLM-5.2-AWQ-INT4-FP8-MTP-delta 魔改版:底座用 INT4(Marlin 算子)+ MTP 用 FP8,使 vLLM 支持...
宇树科技进化对机器人学意义
深度解析:宇树科技的进化对机器人学意味着什么 宇树策略、中国的规模定律、地缘政治及野外的人形机器人 https://www.fabricatedknowledge.com/publish/post/203332874?r=7ekf6a&utm_campaign=post&utm_medium=web&showWelcomeOnShare=true 🔗...
Anthropic指控阿里巴巴大规模蒸馏Claude训练Qwen
Anthropic通过Bloomberg指控,与阿里巴巴相关的运营方利用近25,000个欺诈账户非法访问Claude,在4月至6月期间生成了2880万次Claude交互,目标聚焦于软件工程和智能体推理能力。Anthropic称这是"对抗性蒸馏"模式的一部分,中国企业实验室据称以极低成本从美国前沿模型获取输出以训练竞品系统。该指控矛头直指Qwen系列模型的训练来源。 🔗...
AI编码智能体导致OpenClaw项目PR泛滥:合并率从48%暴跌至9.3%
Greptile观察OpenClaw项目发现,AI编码智能体正大量生成低质量PR。提交量从去年12月每周2个飙升至今年2月每周3400个,合并率从约48%降至9.3%以下。一名贡献者一天内提交106个PR,中位间隔仅3秒。项目开始依据贡献者信誉过滤:首次贡献者合并率8.2%,5次以上为18.6%。Ghostty作者Mitchell...
企业紧急阻止员工用AI处理小任务耗尽预算
企业此前鼓励员工最大化使用AI预算并设立内部排行榜,如今发现token消耗高昂收益甚微,开始进入token配给时代。咨询公司Accenture试图阻止员工用AI完成PDF转PPT等基础任务,而此前该公司曾以"不晋升"威胁员工使用AI。Accenture智能体AI战略负责人Justice...
Gradium 发布实时语音翻译模型 stt-translate 和 s2s-translate
Gradium 发布两款实时语音翻译模型:stt-translate(语音转文本)和 s2s-translate(语音转语音)。两者覆盖英语、法语、德语、西班牙语、葡萄牙语共 5 种语言、20 个语言对,将转录和翻译合并为一步,传统 3 模型级联缩减为 2 模型。stt-translate 在 BLEU 和 MetricX 指标上领先...
Google DeepMind再失两员Gemini关键贡献者,将加入Anthropic
Bloomberg报道,Google DeepMind两位Gemini关键贡献者Jonas Adler和Alexander Pritzel计划离职,加入Anthropic。此前已有John Jumper转向Anthropic、Noam...
GLM-5.2 ARC-AGI-2 得分 22.8%,成本 $0.25
GLM-5.2 在 ARC-AGI-2 上取得 22.8% 的成绩,成本 $0.25/任务 值得注意的是,大约 2025 年 5 月,ARC-AGI-2 上已验证的最佳模型仅为 3.0%。 因此,虽然它仍远落后于 GPT-5.5(85%),但 GLM-5.2 也比 2025 年 5 月的最佳前沿分数高出约 7.6 倍,且每任务成本比 GPT-5.5 的 $1.87 便宜约 7.5 倍。 🔗...
美众议员否认用AI起草国防拨款修正案,但承认用于摘要拼写检查
佛罗里达州共和党众议员Anna Paulina Luna回应X平台截图--一份2027年《国防授权法案》的修正案摘要中出现"Claude responded"字样。Luna最初称工作人员用AI纠正草稿文本,随后澄清仅用于修正案摘要的拼写和语法检查,并强调"NO Legislation is ever drafted with...
请投票支持Codex图像
为这张 Codex 图像投票 https://codex-billboard.vercel.app/images/e0dea850-0c96-4572-b910-5096f64764fd 🔗 阅读原文:https://x.com/jxnlco/status/2069867251541639665
Perplexity推出Computer for Counsel
推出 Computer for Counsel。 Computer 现在连接了律师日常使用的研究数据库、文档工具和案件管理系统。可从中提取可引用来源:@midpageAI、@LegalZoom、@Docusign、@netdocuments 等。 所有 Pro 和 Max 订阅用户均可使用。 🔗...
Perplexity推出Computer for Counsel
推出 Computer for Counsel。 Computer 现在连接了律师日常使用的研究数据库、文档工具和案件管理系统。可从中提取可引用来源:@midpageAI、@LegalZoom、@Docusign、@netdocuments 等。 所有 Pro 和 Max 订阅用户均可使用。 🔗...
Google Gemini 3.5 Flash 计算机使用模型发布
这是 Google 的一次酷发布。 我开始在智能体循环/长时间运行任务中大量依赖计算机使用,并且需要更强大的计算机使用模型,同时保持低成本。不确定 Gemini 3.5 Flash 的效率如何,但我感谢有替代方案。 🔗 阅读原文:https://x.com/omarsar0/status/2069865936618672199
swyx 在 Data+AI Summit 采访 Databricks 联合创始人:智能体云与开放基础设施
swyx 在 Data+AI Summit 上采访了 Databricks 联合创始人 Matei Zaharia 和 Reynold Xin。访谈亮点包括:Databricks 为何击败 Snowflake;行业正纷纷构建"元 harness"(共享智能体框架);LTAP 与 Lakebase 重新思考操作型与分析型数据库划分,解决 HTAP 愿景;Omnigent...
征集最佳 Codex Billboard 作品
请在此为你最爱的作品投票: https://codex-billboard.vercel.app/gallery 【引用 @jxnlco】:发布你最好的 Codex Billboard 作品 🔗 阅读原文:https://x.com/jxnlco/status/2069864042613887220
GLM再添胜绩,开源模型仍有短板
为GLM再添胜绩。该模型有一些脆弱的特性,在这方面被闭源模型压制,但我们应该预期开源模型更加参差不齐,你可以根据任务使用多个模型。再次祝贺@Zai_org,并期待下一个。 🔗 阅读原文:https://x.com/natolambert/status/2069860882944057730
智力可能更关乎更好的知识结构,而非更大的模型
该论文认为当前AI主要建立在网络数学而非知识理论上。人脑以极低功耗做出快速自适应决策,而前沿AI依赖巨大算力。生物智能高效是因为围绕目标、上下文和决策组织意义。论文将心智活动分为物理认知、情绪认知、心智认知和智能,其中智能指在情境仍有效时做出有用决策。提出的"合成智能"将使用结构化语义知识(信息与目的绑定),而非仅依赖语法、统计或神经网络权重。通过不对称信息解析模型展示如何将知识组织成决策图...
请提供需要翻译的推文文本(主推文内容),链接无法直接解析。
🔗 阅读原文:https://x.com/midjourney/status/2069860263692767570
如何设计OpenHarness风格Agent运行时:工具、记忆、权限、技能与多智能体协调
本教程从零构建OpenHarness,一个可运行的Agent运行时,展示完整控制流:接收用户任务、模型决策、验证并执行工具调用、返回观察结果、循环直至任务完成。覆盖核心模块:工具使用与类型化工具架构、权限控制、生命周期钩子、记忆管理、技能、上下文压缩、重试逻辑、Token成本跟踪及多智能体协调。实现采用纯Python,无需API密钥或复杂基础设施即可实验,包含Token成本估算。 🔗...
在与Anthropic的纠纷中,NSA失去了对Mythos的访问权限
美国国家安全局(NSA)因与人工智能公司Anthropic的纠纷,失去了对Mythos系统的访问权限。 🔗 阅读原文:https://www.nytimes.com/2026/06/23/us/politics/nsa-lost-access-anthropic-tool.html
在与Anthropic的纠纷中,NSA失去了对Mythos的访问权限
美国国家安全局(NSA)因与人工智能公司Anthropic的纠纷,失去了对Mythos系统的访问权限。 🔗 阅读原文:https://www.nytimes.com/2026/06/23/us/politics/nsa-lost-access-anthropic-tool.html
开源模型创ARC-AGI-2最强成绩
这是迄今为止开源模型在ARC-AGI-2上取得的最强表现。 🔗 阅读原文:https://x.com/fchollet/status/2069858556552298519
Gemini 3 Pro 率先在 ARC-AGI-2 达 23%
Gemini 3 Pro 是首个在 ARC-AGI-2 上达到至少 23% 的模型,它在 2025 年 11 月就做到了(实际得分 31%)。 所以闭源与开源模型之间 8-12 个月的差距似乎仍然存在。但它们也更参差不齐,有些任务表现更好,有些则更差。 🔗 阅读原文:https://x.com/emollick/status/2069857050016776227
Google Gemini 3.5 Flash 获 Computer Use 能力,OSWorld 得分 78.4
Google 为 Gemini 3.5 Flash 新增 Computer Use 能力,作为内置工具支持智能体计算机操作任务。该模型在 OSWorld-Verified 基准上取得 78.4 分,为谷歌迄今最佳性能。Computer Use 可跨浏览器、移动和桌面环境推理与执行,自动化工单提交等工作流程。 🔗...
Viggle Survivor 新生存游戏已上线
新游戏提示: 🎮 VIGGLE SURVIVOR 现已上线 🎮 上传你的角色 → 堆叠升级 → 迎战无尽波次 → 尽可能久地存活。 任何角色。任何搭配。一个任务:生存。 现在尝试:https://viggle.ai/games/app/ 🔗 阅读原文:https://x.com/ViggleAI/status/2069854107783893484