RSS

  • 宝玉的分享
    https://baoyu.io/feed.xml
    刷新于
  • AIHOT 日报
    https://aihot.virxact.com/feed/daily.xml
    刷新于
  • AIHOT — 全部 AI 动态
    https://aihot.virxact.com/feed/all.xml
    刷新于
  • AIHOT — 精选
    https://aihot.virxact.com/feed.xml
    刷新于

在 AWS、Google Cloud 和 Microsoft Foundry 上使用完整版 Claude Desktop

通过 AWS、Google Cloud 和 Microsoft Foundry 使用 Claude Desktop 的组织现已获得 Chat、Claude Cowork 和 Claude Code 集成的完整桌面体验。IT 团队可将推理保留在自己的云环境中,对话历史本地存储。支持 IAM Identity Center、Workforce Identity...

noreply@aihot.virxact.com (Claude:Blog(网页))

AI需求短期超越摩尔定律

AI demand is outstripping Moore's law in the short run 摩尔定律在2001年至2020年间使计算机和半导体的进口价格下降了52%。(1/4)🧵 🔗 阅读原文:https://x.com/SemiAnalysis_/status/2069163790185234453

noreply@aihot.virxact.com (X:SemiAnalysis (@SemiAnalysis_))

提示注入理论(以及为何应研究角色)

一篇理论论文提出提示注入的本质是角色混淆(role confusion)--攻击通过让模型误判系统角色与用户角色的边界来达成注入。作者论证当前防御措施多聚焦于输入过滤,却忽视了角色本身的可欺骗性,并主张从角色建模入手增强模型对指令来源的区分能力。该工作为理解提示注入提供了统一的理论框架,而非具体防御方案。 🔗 阅读原文:https://role-confusion.github.io/

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

Show HN:Oak--专为代理设计的 Git 替代方案

Oak 是开源版本控制系统,专为 AI 智能体(Claude Code、Codex、Cursor)设计。采用 BLAKE3 内容哈希、内容定义分块、diff/merge 及 Blob/Manifest/Commit/Tree 数据模型,可选 SQLite 和 git 后端。以分支-会话为基本工作单元,用分支描述替代逐次提交,通过内容寻址懒加载使智能体数秒内编辑任意仓库。速度远超...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

Show HN:Oak--专为代理设计的 Git 替代方案

Oak 是开源版本控制系统,专为 AI 智能体(Claude Code、Codex、Cursor)设计。采用 BLAKE3 内容哈希、内容定义分块、diff/merge 及 Blob/Manifest/Commit/Tree 数据模型,可选 SQLite 和 git 后端。以分支-会话为基本工作单元,用分支描述替代逐次提交,通过内容寻址懒加载使智能体数秒内编辑任意仓库。速度远超...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

OpenAI 推出 GPT-5.5-Cyber 模型更新及 Daybreak 安全扩展计划

OpenAI 宣布 GPT-5.5-Cyber 模型更新,在 CyberGym 基准上得分 85.6%(早期版本为 81.9%)。Codex 新增 Security 插件,可在 Codex 内部发现、验证和修复漏洞。作为 Daybreak 扩展计划的一部分,完整版 GPT-5.5-Cyber 模型面向可信防御者;Cyber Partner Program 允许安全公司基于 OpenAI...

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))

Claude Code创建者Boris Cherny:AI智能体循环(loops)真实且重要

Claude Code创建者Boris Cherny在Meta @Scale大会上表示,AI智能体循环(loops)是真实且重要的趋势。他描述自己工作中一个agent持续改进代码架构,另一个寻找重复抽象并提交PR,循环永不停歇。这种循环类似递归函数,由子agent决定何时停止;一种实现是Ralph Loop,检查已完成工作是否达成目标。Loops本质是增加test-time...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

Fugu Ultra 3D 渲染表现惊艳

天哪!Fugu Ultra 在这些 3D 渲染中表现得极其出色。 🔗 阅读原文:https://x.com/omarsar0/status/2069161368771609060

noreply@aihot.virxact.com (X:Elvis Saravia (@omarsar0, DAIR.AI))

Grok Build 发布升级版本

Grok Build 升级 🔗 阅读原文:https://x.com/elonmusk/status/2069161018161311953

noreply@aihot.virxact.com (X:Elon Musk (@elonmusk, xAI))

Claude Code v2.1.186 发布

新增 `claude mcp login/logout` 命令,支持从 CLI 认证 MCP 服务器并完成 SSH 无浏览器重定向。新增 `/workflows` 状态过滤、`/plugin` Skills 部分及 `teammateMode: "iterm2"` 设置。`!` bash 命令改为自动触发 Claude 响应,可通过 `respondToBashCommands`...

noreply@aihot.virxact.com (Claude Code:GitHub Releases(RSS))

xAI 为 Grok Build 推出 /goal 模式,支持长周期自主编码与内置验证

xAI 在终端编码智能体 Grok Build 中新增 /goal 模式。用户输入一条目标指令后,Grok Build 自动规划步骤、生成进度清单,逐一执行并验证(审查代码、检查网页或运行脚本)直至完成。期间可用 `/goal status`、`/goal pause`、`/goal resume`、`/goal clear`...

noreply@aihot.virxact.com (MarkTechPost(RSS))

美国AI基础设施支出预计2027年达中国8.3倍

据推文分析,美国超大规模云厂商到2027E的AI基础设施支出预计约为中国同行的8.3倍,差距悬殊。AI优势当前与算力获取(GPU、数据中心、电力、网络等)高度绑定,更大规模投入意味着在训练前沿模型、运行推理、吸引开发者及补贴AI产品上拥有更广阔空间。引用推文指出,即使考虑购买力平价(PPP),美中AI资本支出差异仍令人震惊;未来几年美国头部AI公司或将比中国竞争对手拥有更庞大的资源推广AI系...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

Codex 助开发者探索新框架加速构建

Codex 就像 iOS 和 macOS 开发者 @PaulSolt 的研究伙伴,帮助他探索新框架,并更快地实现以前无法构建的想法。 🔗 阅读原文:https://x.com/OpenAIDevs/status/2069153778553737605

noreply@aihot.virxact.com (X:OpenAI Developers (@OpenAIDevs))

OpenAI 发布 GPT-5.5-Cyber 在 CyberGym 击败 Mythos 5,扩大 Daybreak 网络安全计划

OpenAI 新模型 GPT-5.5-Cyber 在 CyberGym 基准上击败 Mythos 5,该基准测试 AI 智能体复现已知软件漏洞的能力,对防御性漏洞分析是强信号。OpenAI 同步扩大 Daybreak 计划,包括:Codex Security 插件(在 Codex 内发现、验证并修复漏洞);GPT-5.5-Cyber 完整版(供受信任防御者使用);Cyber Partner...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

OpenAI 发布 GPT-5.5-Cyber 与代码安全更新

Let's Patch The Planet. Codex 安全更新和新 GPT-5.5-Cyber。 网络防御加速的庆祝日。 🔗 阅读原文:https://x.com/thsottiaux/status/2069152290326630518

noreply@aihot.virxact.com (X:Tibo (@thsottiaux))

AI 芯片公司 Groq 完成 6.5 亿美元融资,英伟达 200 亿美元"挖角"后重组高管

6 月 23 日,AI 芯片公司 Groq 宣布完成 6.5 亿美元新融资。此前约 6 个月,英伟达签署非独占性技术许可协议并挖走其创始人兼 CEO Jonathan Ross、总裁 Sunny Madra 等核心员工,交易金额为 200 亿美元。Groq 未披露新估值,上一轮 7.5 亿美元融资后估值为 69 亿美元。Groq 已转向 neocloud 业务,目前运营 13...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

Nvidia想削减数据中心用水,但这不等于解决AI的用水问题

Nvidia宣布一套温水冷却系统,称可在数据中心内部"基本消除所有用水"。冷却液以45°C注入、55°C流出,闭环循环。适宜气候下可实现100%现场用水削减。但外部用水(发电和芯片制造)可使总用水量翻倍或三倍,Nvidia方案仅解决约四分之一到三分之一。目前约一半数据中心电力来自化石燃料,且到2030年新供电中超40%仍依赖天然气和煤。因此仅靠内部节水远未解决AI用水问题。 🔗...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

GLM-5.2 在真实世界智能体基准 GDPval-AA 排名第三,领先所有开源模型

GLM-5.2(max)在真实世界智能体工作基准 GDPval-AA 上获 1524 Elo,排名第三,仅次于 Claude Fable 5(1783)和 Claude Opus 4.8(1615),与 GPT-5.5(xhigh,1509)持平。该模型以约 31 轮次任务平均完成零售主管任务清单、紧急停止电路图等交付物,领先开源权重模型(下一名 MiniMax-M3 仅...

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

AA-Briefcase基准测试:开放权重模型主导成本-性能帕累托前沿

Artificial Analysis发布AA-Briefcase智能体知识工作基准测试,评估模型在长期任务中的表现。任务成本差异超700倍,最高性能模型Claude Fable 5每任务超$20。成本-性能帕累托前沿上,除Anthropic两个最高分模型外,其余大部分由开放权重模型占据。关键性价比:GLM 5.2 (max)每任务$2.40,得分仅比Claude Opus 4.8低90...

noreply@aihot.virxact.com (X:Artificial Analysis (@ArtificialAnlys))

AI用不可能的家欺骗租户

生成式AI让房地产经纪人一键虚拟装修房源照片,导致租户看房时发现现实与图片严重不符。纽约租户Joyce看到带有壁炉、厨房翻新的曼哈顿工作室,实地却发现没有壁炉,炉灶缺旋钮。另一位租户Madison在StreetEasy上看到大量AI增强图片,家具细节明显不真实。佛罗里达州经纪人Bee使用ChatGPT和Stuccco、BoxBrownie等工具为客户演示装修方案,但认为用AI制造虚假房源会引...

noreply@aihot.virxact.com (The Verge:AI(RSS))

Runway Aleph 2.0 改变视频比例适配平台

改变视频的宽高比以适应任何平台。Aleph 2.0 扩展场景以适配新的宽高比,让你的视频看起来从一开始就是那样拍摄的。在今天的 Runway Academy 中了解操作方法。 🔗 阅读原文:https://x.com/runwayml/status/2069147959896240320

noreply@aihot.virxact.com (X:Runway (@runwayml))

OpenRouter 检测 1Password 帮你保存 API 密钥

提示 💡:如果你安装了 @1Password,OpenRouter 会检测到它并帮你保存你的 API 密钥。 🔗 阅读原文:https://x.com/OpenRouter/status/2069144373388820863

noreply@aihot.virxact.com (X:OpenRouter (@OpenRouter))

Gemini Spark 全天候个人AI智能体

Gemini Spark 是您的 24/7 个人AI智能体,在您的指导下从头到尾处理繁重工作。 以下是我们团队使用 Gemini Spark 让生活更轻松、更高效的一些方式。🧵 🔗 阅读原文:https://x.com/GeminiApp/status/2069143097586700794

noreply@aihot.virxact.com (X:Gemini (@GeminiApp))

GLM 5.2 持续获胜

Kim指出,GLM 5.2是首个能以开放权重处理真实自动研究任务的模型,包括调试设置、跨多节点H100集群运行并比较RL训练实验。其局限在于缺少图像理解能力,需程序化分析原始WandB数据而非可视化图表。引用介绍称,GLM 5.2是其自动研究pipeline上首个能胜任实际研究的开源模型,在Fable...

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

opencode推出独立用户排名

我们已添加独立用户排名 某些模型 token 消耗大,导致它们在排名中偏高--使用模型的独立用户数是更准确的排名 我们将围绕这一指标调整更多数据 🔗 阅读原文:https://x.com/opencode/status/2069140423197479225

noreply@aihot.virxact.com (X:opencode (@opencode))

美国机器人公司无法获取所需硬件

这种做法将意味着美国机器人公司无法获得研发所需的硬件。 🔗 阅读原文:https://x.com/SemiAnalysis_/status/2069140417442873760

noreply@aihot.virxact.com (X:SemiAnalysis (@SemiAnalysis_))

Sakana Fugu Ultra发布,性能匹配Fable和Mythos

Sakana AI 推出 Fugu 多智能体编排系统,通过单个模型 API 即可访问。其 'Fugu Ultra' 模型性能匹配 Fable 和 Mythos,提供前沿能力且无出口管制风险。在生成程序化地形(Three.js)的对比中,Fugu Ultra 在一次生成(one-shotted)下表现突出。更多示例即将分享。 🔗...

noreply@aihot.virxact.com (X:Elvis Saravia (@omarsar0, DAIR.AI))

AI 治理清单:LLM 架构先行

Deloitte 报告显示企业 AI 抱负与治理成熟度之间差 53 个百分点,74% 计划两年内部署智能体 AI,仅 21% 拥有成熟治理模型。路由架构是首个治理层。三种姿态--托管网关(如 OpenRouter、Portkey)、自托管网关(如 LiteLLM)和直接 API--默认治理能力不同,直接 API...

noreply@aihot.virxact.com (OpenRouter:Announcements(RSS))

NotebookLM 闪卡支持完全自定义与分享

Flashcards 现已完全可自定义。编辑问题、调整答案、添加新卡片,打造终极学习工具集。 与朋友、同学、学术竞争对手等分享--只需准备好迎接随之而来的无尽赞美与赞誉。 🔗 阅读原文:https://x.com/NotebookLM/status/2069132913866953098

noreply@aihot.virxact.com (X:NotebookLM (@NotebookLM))

OpenAI推出Patch the Planet安全修复计划

Patch the Planet 是 OpenAI 帮助开源维护者从安全发现到合并修复的努力。他们与 Trail of Bits、HackerOne、Calif、研究人员及维护者合作,将 Codex Security 和先进模型引入修复流程,并以人工审查为核心。 🔗 阅读原文:https://x.com/steipete/status/2069132838356840857

noreply@aihot.virxact.com (X:Peter Steinberger (@steipete))
上一页 第 648 / 1023 页 下一页

添加 Feed

导入 OPML