RSS

  • 宝玉的分享
    https://baoyu.io/feed.xml
    刷新于
  • AIHOT 日报
    https://aihot.virxact.com/feed/daily.xml
    刷新于
  • AIHOT — 全部 AI 动态
    https://aihot.virxact.com/feed/all.xml
    刷新于
  • AIHOT — 精选
    https://aihot.virxact.com/feed.xml
    刷新于

NaceAI 超网络知识注入:不改大模型参数也能学新知识

NaceAI 研究提出一种超网络方法,让一个模型学习为另一个模型生成知识更新,无需修改基础模型的数十亿参数。该方法通过添加低秩矩阵来注入新知识,并重定向模型内部计算,将知识注入变为可复用流程。实验表明,目标模型越大,生成的更新泛化效果越好。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2080404518957895722 via AI HOT ·...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

Claude 与 Codex 语音功能对比询问

有人试过 Claude 语音和 Codex 语音吗?能告诉我它们对比如何? 我在工作笔记本上,被禁止使用它。 🔗 阅读原文:https://x.com/jxnlco/status/2080403210192224315 via AI HOT · https://aihot.virxact.com/items/cmry0rc0k0052ro4elqzeeiqm

noreply@aihot.virxact.com (X:Jason Liu (@jxnlco))

ChatGPT桌面端语音控制多Agent上线

OpenAI 为 ChatGPT 桌面应用推出语音模式,用户可通过语音操控 ChatGPT Work 和 Codex 中的多个 AI 智能体。该功能由全双工语音模型 GPT-Live 驱动,支持边说边听边协调任务。即日起面向 macOS 和 Windows 的 Plus、Pro、Business、Edu 及 Enterprise 用户全球推送,iOS 端可通过配对远程访问。 🔗...

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))

Echo:采用开放权重模型,以1/3成本实现媲美Fable的性能

Echo 使用开放权重模型,以 Fable 三分之一成本达到同等性能。该项目在 Hacker News 上获得 104 点热度,展示了开源方案在成本效率上的显著优势。 🔗 阅读原文:https://news.ycombinator.com/item?id=49026810 via AI HOT ·...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

Alexa Plus 更新:连接更多智能家居设备并支持 MCP 开放标准

Amazon 为 Alexa Plus 推出更新,使其能连接 Bosch、iRobot 等品牌的智能家居设备,并自动将请求路由到正确设备。新集成由 AI 开发者工具包驱动,并采用 MCP 开放标准。Canva、Priceline 等公司计划今年晚些时候上线集成。 🔗...

noreply@aihot.virxact.com (The Verge:AI(RSS))

Gemini Spark 向美国 AI Pro 用户开放

Gemini Spark 现已开始向美国地区的 Google AI Pro 订阅用户推送,我们很快将把它推广到更多国家的 AI Pro 订阅用户。 更多关于 Gemini Spark 可用地区的信息请见:https://goo.gle/4fc7349 🔗 阅读原文:https://x.com/GeminiApp/status/2080401074083799229 via AI HOT ·...

noreply@aihot.virxact.com (X:Gemini (@GeminiApp))

Kimi-k3 情商测试惜败,创意写作碾压所有模型

Kimi-k3 在 EQBench 情商测试中以1分之差惜败 fable-5,该基准评估模型与人类对话时能否不卑不亢地有效交流。在创意写作任务中,Kimi-k3 直接碾压现有所有模型。 🔗 阅读原文:https://x.com/karminski3/status/2080399623051718953 via AI HOT ·...

noreply@aihot.virxact.com (X:karminski (@karminski3))

AI 重构虽易,写好测试仍是前提

针对"AI 擅长重构,应疯狂重构"的观点,推文指出软件工程原则未变:重构前必须先写好测试,即使测试由 AI 生成。AI 的真正优势在于出错后反复自我纠错,因此良好的测试覆盖对 AI 编程尤其重要。 🔗 阅读原文:https://x.com/dotey/status/2080394768908013629 via AI HOT ·...

noreply@aihot.virxact.com (X:宝玉 (@dotey))

Claude语音模式升级:支持Opus/Sonnet/Haiku及跨应用操作

Anthropic升级Claude语音模式,现支持Claude Opus、Sonnet和Haiku三款模型,可在对话中切换模型且不丢失上下文。语音模式新增连接Gmail、日历、Slack、Canva和Notion等工具,通过语音执行移动会议、起草邮件等操作。该功能支持10种语言,覆盖移动端、桌面端和网页端,免费用户仍限用Haiku及一个连接工具。 🔗...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

Grok 4.5 已在移动端上线

Grok 4.5 现在也在移动应用上上线了。 立即体验!🚀 🔗 阅读原文:https://x.com/cb_doge/status/2080391624866328976 via AI HOT · https://aihot.virxact.com/items/cmrxzpqbv00i2ropgh6pjl2n4

noreply@aihot.virxact.com (X:cb_doge (@cb_doge))

微软用更便宜自研模型替代前沿模型

微软正将自家产品路由到更便宜的内部 MAI 模型,只要这些模型在任务上匹配前沿质量。MAI 模型在多项任务上超越通用前沿模型,同时仅使用一小部分 token。关键在于"可替换性"而非能力:模型被设计为可替换组件,Copilot 的性能不依赖单一模型,整个系统(评估、记忆、工具、工作流)才是持久优势。 🔗...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

AMD 发布 Helios AI 机架系统,对标 Nvidia

AMD 在 Advancing AI 大会上发布 Helios AI 机架系统,号称"业界最高性能 AI 机架",计划今年晚些时候出货。该系统已在多项指标上超越 Nvidia Vera Rubin,客户包括 OpenAI、Meta、Oracle、Anthropic 和 Microsoft。Anthropic 已与 AMD 达成战略合作,将部署高达 2 吉瓦的 GPU。 🔗...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

Codex 项目支持跨多文件夹工作

在一个 Codex 项目中跨多个文件夹工作。 本地项目现在可以包含来自多个文件夹的相关代码、文档和参考文件。Codex 可以跨这些文件夹进行读写,同时一个主文件夹仍作为 Git 根目录。 🔗 阅读原文:https://x.com/OpenAIDevs/status/2080390328880951299 via AI HOT ·...

noreply@aihot.virxact.com (X:OpenAI Developers (@OpenAIDevs))

Grok 4.5 上线 Grok.com 可试用

在 http://Grok.com 上试试 Grok 4.5 💻 🔗 阅读原文:https://x.com/cb_doge/status/2080390323625488502 via AI HOT · https://aihot.virxact.com/items/cmrxzpqbv00i3ropgqo0ixlv2

noreply@aihot.virxact.com (X:cb_doge (@cb_doge))

Replit 举办首场社区圆桌讨论会

加入我们在 X Spaces 上的首场社区圆桌讨论。 今天下午 3 点(太平洋时间)https://x.com/i/spaces/1DxLddLoByZxm?s=20 🔗 阅读原文:https://x.com/Replit/status/2080389739140567165 via AI HOT ·...

noreply@aihot.virxact.com (X:Replit (@Replit))

Grok 4.5 进展:OpenRouter 使用量激增

Grok 4.5 正在取得进展。 🔗 阅读原文:https://x.com/elonmusk/status/2080389505438396555 via AI HOT · https://aihot.virxact.com/items/cmrxzr5w700kdropg1zivi6wf

noreply@aihot.virxact.com (X:Elon Musk (@elonmusk, xAI))

Poolside 的开放程度被低估:小模型击败 Thinky Machines 并公开完整评测数据集

swyx 指出 Poolside 的开放程度被低估,其小模型在编码任务上击败了 Thinky Machines,并公开了完整评测数据集。CEO Eiso Kant 透露,其 Model Factory 每月运行 1 万至 2 万次实验,新模型迭代最快仅需 8 周。 🔗 阅读原文:https://x.com/swyx/status/2080387171723137440 via AI HOT...

noreply@aihot.virxact.com (X:swyx (@swyx))

反对开源人工智能的论点站不住脚

开源软件是商业软件的基石,包括前沿模型在内的一切软件都构建于开源组件之上。历史表明,压制开源软件极其困难,试图限制开源 AI 只会削弱本国企业而利于国际竞争对手。开源 AI 并非中国独有的现象,英伟达、Thinking Machines Lab 等众多美国商业实体同样有充分动机开发开源模型。 🔗...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

软件工厂为何会失败:仅靠工程化是不够的

软件工厂模式失败的核心原因在于过度依赖工程化流程,而忽视了软件开发的创造性、协作性和不确定性。文章指出,将软件开发简化为流水线式的重复劳动,会扼杀工程师的自主性和问题解决能力,导致效率不升反降。成功的软件交付需要平衡工程规范与人的能动性,而非单纯追求流程标准化。 🔗...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

DARPA 与美国空军试飞 AI 操控的 F-16 战机

DARPA 与美国空军成功试飞了由人工智能操控的 F-16 战机。该 AI 系统在真实空战环境中完成了自主飞行与战术机动测试,标志着 AI 在军事航空领域的重大进展。 🔗 阅读原文:https://www.darpa.mil/news/2026/darpa-us-air-force-fly-ai-controlled-f-16 via AI HOT ·...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

DARPA 与美国空军试飞 AI 操控的 F-16 战机

DARPA 与美国空军成功试飞了由人工智能操控的 F-16 战机。该 AI 系统在真实空战环境中完成了自主飞行与战术机动测试,标志着 AI 在军事航空领域的重大进展。 🔗 阅读原文:https://www.darpa.mil/news/2026/darpa-us-air-force-fly-ai-controlled-f-16 via AI HOT ·...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

Claude 语音模式升级:支持 Opus 4.8 与 Sonnet 5 及多语言

Anthropic 升级 Claude Voice Mode,新增对 Opus 4.8 和 Sonnet 5 模型的支持,并扩展了西班牙语、法语、印地语和日语。语音对话现在可调用已连接的邮件、日历等工具与 Connectors,执行复杂任务。新体验已在网页和移动端逐步上线。 🔗...

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))

AI模型性价比新格局:Fable 5、Grok 4.5与DeepSeek V4对比

Artificial Analysis发布旧金山数字广告牌,展示最新AI模型智能指数与成本对比。Anthropic的Fable 5以60分领先,但平均任务成本$2.75;xAI的Grok 4.5(高)得分54,成本仅$0.31,便宜约9倍;DeepSeek V4 Flash智能得分44,任务成本$0.04,比Fable便宜约69倍。三者均位于帕累托前沿,代表当前最优性价比模型。 🔗...

noreply@aihot.virxact.com (X:Artificial Analysis (@ArtificialAnlys))

Introducing Runway Media Router

🔗 阅读原文:https://runwayml.com/news/company-news/introducing-runway-media-router via AI HOT · https://aihot.virxact.com/items/cmrxxuuk503tsroxp0ner5bcc

noreply@aihot.virxact.com (Runway:News(网页))

Codex 推出 Sites Analytics 公测

您的站点已上线。 现在您可以查看它的运行情况。 Sites Analytics 进入公开测试阶段,为您提供使用 Codex 发布的站点的基本性能指标。 🔗 阅读原文:https://x.com/OpenAIDevs/status/2080383045472075856 via AI HOT · https://aihot.virxact.com/items/cmrxyllfo002tropgp84bc6um

noreply@aihot.virxact.com (X:OpenAI Developers (@OpenAIDevs))

Claude 语音模式现已支持 Opus、Sonnet 及连接工具与多语言

即日起,Claude 语音模式在 Opus、Sonnet 和 Haiku 上运行,并支持连接 Gmail、Slack 等工具及更多语言。用户可在对话中切换模型,语音模式默认沿用上次文本聊天使用的模型。该功能面向所有用户开放 beta 测试,免费版可使用 Haiku 及一个连接工具,付费版可访问更多模型和全部连接工具。 🔗...

noreply@aihot.virxact.com (Claude:Blog(网页))

Claude 语音模式现已支持 Opus、Sonnet 及连接工具与多语言

即日起,Claude 语音模式在 Opus、Sonnet 和 Haiku 上运行,并支持连接 Gmail、Slack 等工具及更多语言。用户可在对话中切换模型,语音模式默认沿用上次文本聊天使用的模型。该功能面向所有用户开放 beta 测试,免费版可使用 Haiku 及一个连接工具,付费版可访问更多模型和全部连接工具。 🔗...

noreply@aihot.virxact.com (Claude:Blog(网页))

医疗账单平台4个月建成7个生产级AI智能体

一家PE支持的医疗账单平台用4个月建成7个生产级AI智能体,处理真实医保理赔,零患者数据暴露。团队在构建数据富化管道(每笔理赔预计算34个动态变量)和评估框架上投入的工程时间远超模型集成。系统跨两个模型提供商路由调用,切换模型不影响输出结果。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2080381086480097479 via AI HOT ·...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

OpenAI 应公布HF黑客事件详细记录

OpenAI 对谄媚模型就是这么做的,那是一篇很棒的文章,我希望他们能延续这一趋势! 🔗 阅读原文:https://x.com/natolambert/status/2080379686287516114 via AI HOT · https://aihot.virxact.com/items/cmrxxj11c03lzroxppba2u4r5

noreply@aihot.virxact.com (X:Nathan Lambert (@natolambert))

英美安全机构联合评估:Kimi K3网络能力落后于美国前沿模型

英美政府安全机构联合报告显示,Kimi K3在攻击性网络能力上平均在第17步停止,而最强美国模型可达28.5步。在ExploitBench评测中,美国领先模型得分76.2%,Kimi K3仅32.2%,GLM-5.2为24.4%。Kimi K3虽能自主执行部分攻击步骤,偶尔完成模拟企业攻击,但整体仍显著落后于美国前沿模型,且不会可靠拒绝攻击性请求。 🔗...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))
上一页 第 324 / 982 页 下一页

添加 Feed

导入 OPML