RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
Microsoft在Excel和Outlook中用自家AI替代OpenAI和Anthropic以降低Copilot成本
Bloomberg报道,Microsoft正在Excel和Outlook中用自家模型替代OpenAI和Anthropic的模型,以减少Copilot的推理成本。此前这些应用更依赖外部模型,微软希望减少向控制前沿模型定价的外部实验室支付昂贵调用费用。虽然OpenAI因长期合作仍给予微软优惠,但折扣可能逐渐消退。微软AI负责人Mustafa...
Gemini 为创业者演示工作流与增长
致所有个人创业者和中小企业主!📣 参加我们的下一场直播演示,了解 Gemini 如何助力你的工作流与业务增长。Google 产品经理将带你了解如何解锁个性化洞察、自动化重复任务,并为你的业务构思新内容。 👉 加入 Discord 观看直播:http://discord.gg/gemini 📅 明天(周三,7月8日)太平洋时间上午11:30 🔗...
Claude Fable 5 付费访问延至 7 月 12 日
太棒了.. Anthropic 刚刚将 Claude Fable 5 付费计划访问延长至 7 月 12 日。 此前每周 50% 使用上限保持不变,即 Fable 5 只能消耗你每周 Claude 额度的一半。 (你的每周总额度是一个后台使用预算,长对话、文件、工具以及更重型的模型会消耗得更快) 🔗...
Claude Fable 5 延长访问至 7 月 12 日
还有 5 天,Fable 5 持续到 7 月 12 日。 希望 Anthropic 届时能有足够算力让它留在订阅层。 🔗 阅读原文:https://x.com/kimmonismus/status/2074553154117443825 via AI HOT · https://aihot.virxact.com/items/cmrayy6pv02a0ihogjbq0kwks
Gemini API Managed Agents 重大更新
今天我们正在为 Gemini API 中的 Managed Agents 推出一些重大更新: - 支持后台任务 - 远程 MCP 和函数调用 - 网络凭证刷新 现在您还可以通过免费层级开始使用 API 中的 Managed Agents! 🔗 阅读原文:https://x.com/OfficialLoganK/status/2074552932318765376 via AI HOT ·...
Cohere Transcribe Arabic:专为阿拉伯语最棘手转录问题打造的开源模型
Cohere 发布开源语音识别模型 Cohere Transcribe Arabic,参数量为 20 亿,专为解决阿拉伯语方言多样性、双语对话、代码切换和术语识别等难题设计。该模型在基准测试中超越 Whisper Large V3、标准 Cohere Transcribe 模型及其他系统,据称是目前最准确的阿拉伯语开源语音转文本系统。模型采用 Apache 2.0 许可,已在...
YC CEO声称每日用AI部署3.7万行代码,开发者审查发现前端代码大量臃肿低效
Y Combinator CEO Garry Tan在X上宣称,他与AI编码代理每天在五个项目中部署37000行代码,并保持连续72天发布记录。波兰开发者Gregorein深入审查Tan网站前端代码,发现大量臃肿与低效问题:页面加载169次请求、总计6.42MB数据(对比Hacker...
YC CEO声称每日用AI部署3.7万行代码,开发者审查发现前端代码大量臃肿低效
Y Combinator CEO Garry Tan在X上宣称,他与AI编码代理每天在五个项目中部署37000行代码,并保持连续72天发布记录。波兰开发者Gregorein深入审查Tan网站前端代码,发现大量臃肿与低效问题:页面加载169次请求、总计6.42MB数据(对比Hacker...
NotebookLM短视频概览正式上线
短视频概览功能已正式在移动端和网页端面向所有英语用户全面上线! 一如既往,您的意见对我们至关重要。请在下方分享您最喜欢的作品,并告诉我们接下来需要添加哪些功能!❤️ 🔗 阅读原文:https://x.com/NotebookLM/status/2074551227594264799 via AI HOT ·...
NotebookLM短视频概览正式上线
短视频概览功能已正式在移动端和网页端面向所有英语用户全面上线! 一如既往,您的意见对我们至关重要。请在下方分享您最喜欢的作品,并告诉我们接下来需要添加哪些功能!❤️ 🔗 阅读原文:https://x.com/NotebookLM/status/2074551227594264799 via AI HOT ·...
Anthropic 在移动端和网页端推出 Claude Cowork
自周二起,Anthropic 的 Claude Cowork 首次在移动端(iOS 和 Android)和网页端上线,先面向 Max 订阅者开放,其他计划用户将在未来几周内获得。此前仅限 macOS 和 Windows 桌面应用。Cowork 会话现默认在云端运行,可跨设备继续,即使关闭笔记本电脑也能在后台运行任务;桌面版仍保留本地处理选项。计划任务可在所有设备离线时运行,Claude...
MiniMax M3 与 Kimi 模型挑战世界杯预测
Kilo's WorldCupBench 测试了 MiniMax 与 Kimi 的开放权重模型对世界杯结果的预测能力。 Kickoff. ⚽️ Let's see if M3 can bring it home. 🔗 阅读原文:https://x.com/MiniMax_AI/status/2074550049976229894 via AI HOT ·...
Claude Fable 5 付费计划访问延长至7月12日
Claude Fable 5 在所有付费计划上的访问权限已延长至 7 月 12 日。主推文回应:好的,成功了。 🔗 阅读原文:https://x.com/Yuchenj_UW/status/2074549408151273782 via AI HOT · https://aihot.virxact.com/items/cmrayozck0272ihoghhsg3c2r
Claude Fable 5付费计划延长至7月12日
ANTHROPIC 🔥: Claude Fable 5 将保留在所有付费计划中,直至7月12日! 还有5天测试时间👀 能不能也重置一下Fable 5? 🔗 阅读原文:https://x.com/testingcatalog/status/2074549386588127242 via AI HOT ·...
Claude Fable 5 付费计划延长至7月12日
我们将所有付费计划对 Claude Fable 5 的访问延长至7月12日。 🔗 阅读原文:https://x.com/claudeai/status/2074548242386178258 via AI HOT · https://aihot.virxact.com/items/cmray45di022vihogzrakhkjd
Cybercab 真是一件艺术品
Cybercab 真是一件艺术品。 🔗 阅读原文:https://x.com/cb_doge/status/2074547065624101038 via AI HOT · https://aihot.virxact.com/items/cmraxicjc01wqihogr808rj0b
微软ICML亮点:Fara 1.5、抗批评基准等
在首尔ICML上,微软100多篇被接收论文、3场口头报告和1个展区演示中,亮点包括Fara 1.5计算机使用智能体、抗批评基准测试、通过FLIP2扩展的蛋白质机器学习基准,以及改进的大语言模型推理稳定性。https://msft.it/6019vaCHU 🔗 阅读原文:https://x.com/MSFTResearch/status/2074546659602632832 via AI...
Anthropic 向 Claude Max 订阅用户推送 Claude Cowork 移动端与网页版
Anthropic 开始向 Claude Max 订阅用户推送 Claude Cowork 的移动端与网页版,其他计划的用户将在未来几周内获得。移动端与网页端的 Cowork 支持用户触发、跟进任务,以及定时任务。此前 @claudeai 宣布 Chat 和 Cowork 将在网页和桌面端合并为统一界面,项目和工件集中在同一区域。本次更新是该系列的第一个功能,后续还有语音模式升级和...
Fable过度修饰语言持续困扰项目
有关 Fable 的过度修饰语言是软件和设计项目中的一个持续问题,尽管 AI 在其他方面表现出色。即便你试图给出相反指示,它还是会悄悄渗入小段文字、弹窗通知和菜单中。一旦进入,就很难彻底清除。 🔗 阅读原文:https://x.com/emollick/status/2074545147908378720 via AI HOT ·...
NVIDIA 将 Nemotron-3-Super 压缩为 Puzzle-75B-A9B,吞吐量翻倍
NVIDIA 将混合 MoE 大模型 Nemotron-3-Super 压缩为 Puzzle-75B-A9B。通过联合结构搜索同时优化异构 MoE 剪枝、活跃参数预算和 Mamba 剪枝,配合蒸馏、强化学习、量化及多 token 预测头的迭代流程,在保持质量的同时将交互式服务器吞吐量提升约 2 倍。在单台 8×B200 节点上达约 2 倍父模型吞吐量,单个 H100 上 1M token...
年轻AI人才:LeetCode面试该淘汰
我最近和一些年轻AI人才交流。许多人对仍使用LeetCode面试的公司感到反感。 逻辑很简单:LeetCode主要测试记忆力。在AI时代,甚至3B参数的LLM都能比任何人类更快地解决这些问题。 科技行业应转向AI辅助的现实问题解决式的编程面试。 🔗 阅读原文:https://x.com/Yuchenj_UW/status/2074543329665233236 via AI HOT ·...
Artificial Analysis 发布 Harvey LAB-AA 法律智能体基准
Artificial Analysis 推出 Harvey LAB-AA,基于 Harvey 构建的 120 项任务(覆盖 24 个法律实践领域),以全部通过率评估模型质量。Claude Fable 5(max)以 14.2% 领先,Claude Opus 4.8(max)与 GLM-5.2(max)并列 7.5%,MiniMax-M3 6.7%,Claude Sonnet 5...
Fable 5 发布凸显智能体编排重要性
Fable 5 的发布恰恰凸显了智能体编排的重要性。大多数任务其实并不需要 Fable 5。你可以用 Opus 4.8/Fable 5 做规划,用 GPT-5.5 执行,用 GLM-5.2 做设计。通过精心编排,你可以更好地最大化利用你的模型 token。 🔗 阅读原文:https://x.com/omarsar0/status/2074541418815553726 via AI HOT...
Cloudflare 推出货币化网关,让 AI 智能体付费获取网页/API
Cloudflare 宣布推出货币化网关(Monetization Gateway),基于 x402 开放协议,在边缘侧要求 AI 智能体支付后才能获取受保护资源。网站所有者可为网页、数据集、API 或 MCP 工具设定每次调用价格(如 $0.01)。智能体请求时收到 402 Payment Required...
Anthropic 将 Claude Cowork AI 智能体扩展至移动端和网页端
Anthropic 将 AI 智能体 Claude Cowork 从桌面应用扩展至移动端和网页端,Beta 访问逐步向 Max 订阅用户开放。用户可跨设备启动、检查并获取任务结果,Claude 持续在后台运行,即使合上设备也不中断。"人在回路"功能移至手机端--需要人工决策时智能体会请求审核,用户批准后才执行。Anthropic 表示超 90%...
Claude Cowork 移动端上线,后台运行颠覆 Agent 工作模式
Claude Cowork 正式登陆移动端和网页端(Beta 版,Max 用户优先)。用户可在桌面端分配任务后关闭电脑,Claude 在后台自主完成邮件处理、会议转录、行业搜索、报告撰写等知识工作,仅需用户决策时推送手机通知。官方称九成场景非编程,所有知识工作可托管。Max 用户测试期使用限额翻倍至 8 月 5 日,网页端无需客户端即可运行。 🔗...
Google 为 Gemini API 托管代理扩展四项新功能
Google AI for Developers 宣布为 Gemini API 托管代理新增四项功能:1)长时间运行后台执行,支持服务器端异步交互,无需保持 HTTP 长连接;2)远程 MCP 服务器连接,可直接对接私有数据库、内部及外部 API,无需代理中间件;3)自定义函数调用,可在内置沙箱工具中无缝添加自定义工具;4)网络凭据刷新,支持在会话中轮换 API...
Liquid AI 开源 Antidoom:基于最终 Token 偏好优化的推理模型死循环修复方法
Liquid AI 开源了 Antidoom,一种基于 Final Token Preference Optimization (FTPO) 的针对性修复方法,用于减少推理模型中的 doom loop(死循环)问题。该方法定位循环开始的第一个 token,训练模型选择连贯替代项,而不改变整体输出分布。在 LFM2.5-2.6B 上,硬数学和编程任务中的循环率从 10.2% 降至...
Liquid AI 开源 Antidoom:基于最终 Token 偏好优化的推理模型死循环修复方法
Liquid AI 开源了 Antidoom,一种基于 Final Token Preference Optimization (FTPO) 的针对性修复方法,用于减少推理模型中的 doom loop(死循环)问题。该方法定位循环开始的第一个 token,训练模型选择连贯替代项,而不改变整体输出分布。在 LFM2.5-2.6B 上,硬数学和编程任务中的循环率从 10.2% 降至...
Codex/Claude code vibe coding技巧:强制复用成熟方案
分享一个Codex、Claude code等AI编程工具的vibe coding技巧:在prompt末尾添加"GitHub上有成熟的开源方案,直接复用,不要自己实现。优先搜索流行库/组件并集成,只写必要的glue code",强制AI优先复用现有方案。原因是AI倾向于从零造轮子,尤其对认证、状态管理、复杂UI等复杂功能容易写出冗长易错代码,通过该指令能减少工作量和bug。 🔗...