RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
Claude Opus 5 发布,价格减半效率提升
Claude Opus 5 来了。 价格是 Fable 5 的一半,这很棒!但重点是 token 效率。我喜欢这个方向,我们需要既前沿又实惠的智能。 🔗 阅读原文:https://x.com/omarsar0/status/2080701556425400427 via AI HOT · https://aihot.virxact.com/items/cmrz7m7bh00eqrox8177oard6
Claude Opus 5 发布:半价接近 Fable 5 前沿智能
Anthropic 发布 Claude Opus 5,API 输入/输出价格分别为每百万 token 5 美元和 25 美元,与 Opus 4.8 相同,仅为 Fable 5 的一半。 🔗 阅读原文:https://x.com/dotey/status/2080701514402730046 via AI HOT ·...
Claude Opus 5 发布,性能超 Opus 4.8
来了!Opus 5 模型发布,价格跟 Opus 4.8 相同 在测评成绩上大幅优于 Opus 4.8,同时相当多的测评成绩都高于 Fable 5。 终于有个能用的模型了! 要再不出,我感觉 Claude Max 都没必要续订了,性价比过低,4.8 跟屎一样 🔗 阅读原文:https://x.com/op7418/status/2080701512679145525 via AI HOT ·...
Opus 5 惊人数据:迭代加速与强化学习效果显著
Opus 5 的数据惊人,更快的迭代速度加上规模化强化学习的力量(Fable 也大到还无法进行强化学习)。关于安全措施:"根据我们的测试,我们预计分类器的干预频率将比 Fable 5 减少约 85%。" 开干吧。 🔗 阅读原文:https://x.com/natolambert/status/2080701405409784268 via AI HOT ·...
微软与Broad研究所用AI推进精准肿瘤学
AI如何助力推进精准肿瘤学?探索Project Ex Vivo,这是微软研究与Broad研究所的合作项目,并得到Dana-Farber癌症研究所的支持,该项目利用AI更好地理解癌细胞状态。阅读Signal Magazine上的故事:https://msft.it/6010v7Jup 🔗...
Opus 5 发布:性能超越 Fable 5,价格减半
没想到今天会是 Opus 5 发布日! Opus 5 在几乎所有基准测试上都击败了 Fable 5。它在编码和智能体能力上似乎有重大飞跃,且模型 token 效率大幅提升。 而且它的价格只有 Fable 5 的一半。迫不及待想试试了。 🔗 阅读原文:https://x.com/Yuchenj_UW/status/2080700745087951079 via AI HOT ·...
Anthropic 发布 Opus 5,性能超越 Fable 5 且限制更少
Anthropic 推出 Opus 5,这是其旗舰模型的最新版本。Opus 5 在多项基准测试中超越 Fable 5,且不受 Fable 和 Mythos 的 30 天数据保留政策限制,价格更低、限制更少。新模型还引入了 Automatic Fallbacks 测试功能,可在触发安全分类器时自动将请求路由至较弱模型,避免返回错误信息。 🔗...
Meta AI 升级为个人助手:接入日历生成简报,支持深度研究与持续任务
Meta 为其 AI 聊天机器人推出新生产力功能,使其能接入日历生成每日简报、规划活动,并执行可中途调整方向的深度研究。该更新由新发布的 Muse Spark 1.1 模型驱动,标志着 Meta 从"娱乐优先"转向"个人超级智能"战略。新版 Meta AI 即日起在 Meta AI 应用和网页端"部分市场"上线,未来数周将扩展至 WhatsApp 等平台。 🔗...
Anthropic 发布 Claude Opus 5,安全防护强于前代且接近 Fable 5 能力
Anthropic 发布 Claude Opus 5,官方称其在多个领域"接近 Claude Fable 5 的能力",复杂编程任务表现更优。该模型网络安全防护强于前代 Opus 4.8,定价与前任相同(输入 5 美元/输出 25 美元)。 🔗...
Replit 本月推出语音对话与Claude集成
Replit 本月发货量很大。用语音与 Agent 对话,从 Claude 或 Slack 构建,再也不用向 Agent 重新解释你的技术栈。完整概述: 🔗 阅读原文:https://x.com/Replit/status/2080699531662967018 via AI HOT · https://aihot.virxact.com/items/cmrz7lbiu00e0rox8wjaq51e6
Claude Opus 5 发布,性能接近 Fable 5 价格减半
Introducing Claude Opus 5. 这是一款深思熟虑且主动的模型,以一半的价格接近 Fable 5 的前沿智能水平。 🔗 阅读原文:https://x.com/claudeai/status/2080699495453528290 via AI HOT · https://aihot.virxact.com/items/cmrz7mxh000itrox8bvd6vvvs
Google 详解 Ray AI 库在 TPU 上的运行:Serve、Data 与 Train 抽象化多主机调度与分布式训练
Google 在第二篇技术文章中展示了 Ray Serve、Ray Data 和 JaxTrainer 如何抽象化 TPU 切片上的 AI 工作负载复杂性。Ray Serve 通过简单拓扑配置实现多主机模型的 gang-scheduling,Ray Data 以原生 JAX 批次直接供给加速器以消除数据加载瓶颈,JaxTrainer 则自动处理跨切片协调、检查点与容错,简化分布式训练。 🔗...
英伟达微软等25家组开放权重联盟
英伟达CEO黄仁勋在X发布首条帖子,与微软纳德拉同步发布联名公开信《Open Weights and American AI Leadership》,联合Meta、Hugging Face、Mistral、a16z、YC等25家机构组成开放权重联盟。OpenAI、Anthropic、谷歌明显缺席,AI产业开放权重与闭源前沿模型两大阵营正式公开对立。 🔗...
Glif 智能体掌握 Google Omni 提示技巧
Fabian 煮的咖啡最好喝。 🔗 阅读原文:https://x.com/fofrAI/status/2080690515490513011 via AI HOT · https://aihot.virxact.com/items/cmrz6ivzm0039rox8gyxnhwq4
Meta、Microsoft、Nvidia、IBM 等二十余家企业联名致信美国政策制定者,呼吁保护开源 AI 模型
Meta、Microsoft、Nvidia、IBM、Dell Technologies、CrowdStrike、Palantir、ServiceNow、Hugging Face、Perplexity、Mistral 等二十多家公司与组织签署公开信,敦促美国政策制定者保护开源权重(open-weight)AI 模型。该信函于今日发布,签署方涵盖直接商业竞争对手及商业模式差异显著的组织。 🔗...
大型研究:ChatGPT 未显著影响大学成绩
一项基于美国某大型大学行政数据的研究发现,ChatGPT 引入后,易受 GenAI 影响的课程(如居家论文)成绩并未出现不成比例的增长,学生课程评价也无显著变化。研究指出,GenAI 并未明显导致学习替代或降低学生满意度,但结果受 COVID 干扰等因素影响,应视为提示性而非结论性。 🔗...
微软联合20余家公司签署公开信,力推开源权重模型与知识蒸馏
微软联合Meta、Nvidia、Hugging Face等20余家公司签署公开信,主张开源权重模型和知识蒸馏的合法性,以推动美国AI生态开放。同时,微软正用自研MAI模型替换GitHub Copilot、Excel和Outlook中的OpenAI与Anthropic模型,MAI可在H100和A100等旧GPU上运行,以降低部署成本。 🔗...
黄仁勋首条推文力挺开源模型
黄仁勋开通Twitter账号并发布首条推文,公开支持开源模型与开源生态,成为近期美国关于是否封禁中国顶尖开源模型讨论中首位明确站队的行业头部CEO。他主张美国不应将AI领导力理解为保护少数巨头公司的领先地位,否则可能输掉整个AI战争,真正的优势应来自开放模型、算力基础设施与生态应用。他呼吁为初创公司提供更多算力、建设共享数据集与评估体系,并反对因潜在风险过早限制开源模型。 🔗...
Sam Altman 支持美国在开源与闭源 AI 领域领先
Sam Altman 表示希望美国在开源和闭源 AI 模型上均取得领先,并乐见相关进展。他引用 NVIDIA 黄仁勋发布的公开信,该信强调开源模型能强化安全与网络安全、加速创新与扩散,并支持主权 AI。信中指出,世界既需要前沿闭源模型,也需要前沿开源模型。 🔗 阅读原文:https://x.com/sama/status/2080683363174945065 via AI HOT ·...
Sam Altman 征求 Pro-Ultra-Superhard 反馈
请告诉我们你对 pro-ultra-superhard 的看法。 🔗 阅读原文:https://x.com/sama/status/2080683119959757243 via AI HOT · https://aihot.virxact.com/items/cmrz5e38r022iroey8bedwdpn
黄仁勋首条X帖:开放模型才是美国AI领导力根本
黄仁勋在X发布首条帖文,联署25家公司公开信,强调开放模型对美国AI领导力至关重要,获马斯克秒转支持。他精准卡位美国政策讨论风口,将英伟达商业利益包装成政治正确:开放模型扩散才能持续拉动GPU需求,而非封闭模型集中于少数大公司。此举意在从"卖卡者"转型为AI规则定义者。 🔗 阅读原文:https://x.com/AYi_AInotes/status/2080682370605174833...
多家AI公司签署公开信,敦促美国政策制定者不要对开源权重模型实施"过早限制"
Hugging Face、Meta、微软、Mistral 和 Nvidia 等公司签署公开信,敦促政策制定者不要对开源权重AI模型实施"过早限制"。信中指出,知识蒸馏是广泛使用的合法技术,不应与知识产权盗用混为一谈,应通过针对性法律框架而非全面限制来应对。该信背景是特朗普政府正考虑禁止中国开源权重模型。 🔗...
NVIDIA CEO黄仁勋首条X推文:联合Meta、微软等呼吁支持开源AI
NVIDIA CEO黄仁勋发布其X平台首条推文,联合Meta、微软、Mistral等公司共同呼吁支持开源AI。联盟主张开放模型能让企业和国家审查、修改和运行AI,从而减少对少数供应商的依赖并增强数据控制权。推文强调前沿闭源与开源模型应共存,开源必须保持合法。 🔗 阅读原文:https://x.com/kimmonismus/status/2080679682085618021 via AI...
微软开源27B电脑操作Agent,可替代RPA
微软发布Fara1.5-27B,一个基于Qwen3.5架构的27B参数多模态Agent,能看图像、读文字并像人一样控制电脑。它专为computer-use场景设计,可浏览网页、填表单、从截图提取数据、点击按钮,实现网页自动化。该模型开源且体量适中,适合本地部署和自托管,降低了可靠电脑操作模型的门槛。 🔗...
美中AI开源闭源模型引发地缘讨论
如果所有前沿闭源模型不是在美国开发,而所有前沿开源模型不是在中国开发,那么关于开源权重模型的讨论就不会那么令人担忧。 这意味着,关于开放性和AI的讨论不可避免地会涉及许多其他问题。 🔗 阅读原文:https://x.com/emollick/status/2080677705045975055 via AI HOT ·...
NVIDIA 签署公开信支持开放模型
这非常重要。 🔗 阅读原文:https://x.com/Thom_Wolf/status/2080677395812520089 via AI HOT · https://aihot.virxact.com/items/cmrz5hrf70272roeygm1sb0os
马斯克力挺黄仁勋:支持开源AI模型
英伟达CEO黄仁勋在X发布首条推文,公开呼吁支持开源AI模型。他签署的公开信指出,开源模型能加速创新、增强安全、促进竞争并降低成本。马斯克回应"全力支持,黄仁勋说得对",强调世界需要前沿闭源与开源模型并存。 🔗 阅读原文:https://x.com/cb_doge/status/2080676406351294885 via AI HOT ·...
Codex 玩笑式提示生成有趣论文
作为玩笑,我提示 Codex "构建并运行 BenchBench,一个衡量 AI 创建基准能力的基准。然后弄清楚 benchbenchbench 是什么并运行它。接着把 benchbenchbench 写成一篇像样的 arXiv 论文。"我得到了一份 PDF。 但这篇论文实际上还挺有意思的? 🔗...
Anthropic 联合 Andon Labs 发布 Drone-Bench,评估 AI 模型自主操控无人机执行定位追踪任务的能力
Anthropic 与 Andon Labs 合作推出 Drone-Bench,用于测试 AI 模型自主操控四旋翼无人机在室内环境中定位并追踪指定人员的能力。该基准将任务分解为 3D 地图重建、定位、导航、目标检测与跟随五个子任务,并通过软件复现实现快速评估。实验表明,该任务链的难度足以区分不同智能水平的模型,并揭示 AI 在物理世界操控能力上的进步轨迹。 🔗...
Anthropic 联合 Andon Labs 发布 Drone-Bench,评估 AI 模型自主操控无人机执行定位追踪任务的能力
Anthropic 与 Andon Labs 合作推出 Drone-Bench,用于测试 AI 模型自主操控四旋翼无人机在室内环境中定位并追踪指定人员的能力。该基准将任务分解为 3D 地图重建、定位、导航、目标检测与跟随五个子任务,并通过软件复现实现快速评估。实验表明,该任务链的难度足以区分不同智能水平的模型,并揭示 AI 在物理世界操控能力上的进步轨迹。 🔗...