RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
借助 Workload Identity Federation 安全访问 Claude Platform
Workload Identity Federation (WIF) 已在 Claude Platform 上全面可用。WIF 兼容任何 OIDC 身份提供者,覆盖所有 Claude API 端点(包括第一方 SDK 和 Claude Code)。WIF 用短生命期凭证替代静态 API 密钥,并引入服务账户,每个工作负载拥有独立身份、角色和审计日志。Claude Console...
Claude Design 更新:跨项目保持品牌一致,与Claude Code协同
6月17日,Claude Design 更新,支持跨项目使用统一设计系统,并与Claude Code同步工作流。用户可直接拖拽、对齐和缩放画布元素,编辑器稳定性大幅提升。设计系统可从GitHub、设计文件或原始上传导入,团队管理员可锁定标准系统防止篡改。新增桌面端侧边栏入口及独立网页端claude.ai/design。使用限制与聊天、Claude Cowork、Claude...
借助 Workload Identity Federation 安全访问 Claude Platform
Workload Identity Federation (WIF) 已在 Claude Platform 上全面可用。WIF 兼容任何 OIDC 身份提供者,覆盖所有 Claude API 端点(包括第一方 SDK 和 Claude Code)。WIF 用短生命期凭证替代静态 API 密钥,并引入服务账户,每个工作负载拥有独立身份、角色和审计日志。Claude Console...
Claude Design 更新:跨项目保持品牌一致,与Claude Code协同
6月17日,Claude Design 更新,支持跨项目使用统一设计系统,并与Claude Code同步工作流。用户可直接拖拽、对齐和缩放画布元素,编辑器稳定性大幅提升。设计系统可从GitHub、设计文件或原始上传导入,团队管理员可锁定标准系统防止篡改。新增桌面端侧边栏入口及独立网页端claude.ai/design。使用限制与聊天、Claude Cowork、Claude...
OpenAI 发布 LifeSciBench 生命科学基准测试
推出 LifeSciBench,一个用于衡量和改进 AI 如何支持现实世界生命科学研究的基准测试。 该基准测试与 173 位来自生物技术和制药研究的科学家共同开发,包含 750 项专家编写的任务,覆盖七个生物学研究工作流程。
OpenAI 发布 LifeSciBench 生命科学基准测试
推出 LifeSciBench,一个用于衡量和改进 AI 如何支持现实世界生命科学研究的基准测试。 该基准测试与 173 位来自生物技术和制药研究的科学家共同开发,包含 750 项专家编写的任务,覆盖七个生物学研究工作流程。
Anthropic风波最大赢家:开源,GLM 5.2发布正当时
多家主流媒体(Bloomberg、Fortune、CNBC)一致认为,Anthropic争议的最大赢家是开源。Bloomberg指出,开源模型可本地运行,无需担心被随意撤下。被切断访问的企业和国家联盟会寻求主权解决方案,而目前最强大的开源模型来自中国,这无意中利好中国。推文认为GLM 5.2发布恰逢其时,开源成为保障独立参与AI革命的关键。
GLM-5.2 登顶 Design Arena,Elo 1360 超 Claude Fable 5
GLM-5.2 在 Design Arena 上以 Elo 1360 跃居第一,超过已下架的 Claude Fable 5,排名提升 4 位、Elo 提高 27 分,且为开源权重。DAIR.AI 的 Elvis Saravia 实测认为其设计能力不错,虽未达专业设计师水平,但具备 Opus 级质量,擅长游戏、落地页、HTML artifacts 及 3D 世界等任务。
Claude Design更新:更广设计系统、画布编辑器与Code同步
Anthropic 的 Claude Design 迎来更新,新增对更广泛设计系统的支持,附带画布编辑器(可直接拖拽、调整大小和对齐元素),并能与 Claude Code 实现双向同步协作。Claude Design 会在构建前使用真实组件检查输出是否符合设计系统。该功能目前处于 beta 阶段,面向所有付费计划用户,可在 Web 和桌面端使用。
2025年底AI策略落后于智能体革命
大型公司AI策略的一个大问题是,那些去年意识到AI重要性的公司(实际上只是很小一部分,大多数仍然行动缓慢),最多是在2025年底、智能体革命之前制定了他们的策略 自此,情况已变…
Launch HN: Adam(YC W25)--开源人工智能CAD
Adam 是一个开源 AI CAD 工具,可将自然语言和图像输入转化为 3D 模型。它完全在浏览器中运行(基于 WebAssembly),提供参数化滑块调节和实时预览(Three.js),支持导出 .STL、.SCAD、.DXF 格式,内置 BOSL、BOSL2 和 MCAD 库。基准测试显示,从单一提示词即可生成全参数化 OpenSCAD 模型,包括 V8 发动机、9...
Snap 发布天价 AR 眼镜 Specs 后股价暴跌
Snap 发布 AR 眼镜 Specs,零售价近 2200 美元。消息公布后股价下跌超 5%,从 $5.86 跌至 $4.83。CEO Evan Spiegel 称其定位为高可穿戴性的沉浸式计算设备,价格与高端笔记本相当。但核心用户青少年缺乏购买力,市场对其盈利前景存疑。
NEA合伙人Tiffany Luck:企业仍在摸索AI投资回报率
年初硅谷掀起"tokenmaxxing"热潮,CEO鼓励员工最大化AI使用量,随后账单涌现:Uber数月内耗尽年度AI预算,部分公司削减组织内的Claude许可证,Meta取消内部AI排行榜。NEA合伙人Tiffany Luck认为企业仍在摸索AI投资回报率,她在TechCrunch播客中谈到个人智能体前景、今年AI IPO以及帮助追踪AI支出的创业公司机遇。
Seedance 2.5 七月初发布,文生视频领先
Holy Sh*t: Seedance 2.5 七月初发布。 并且仍然没有任何文生视频模型能接近 Seedance。
David Sacks批Anthropic对抗白宫,Fable-5或需重大调整
白宫AI和加密货币主管David Sacks回应争议,澄清自己并未淡化Mythos的网络威胁,而是质疑Anthropic的恐吓策略。他重申威胁真实,呼吁防御者快速修补漏洞,并批评Anthropic对政府的对抗姿态分散了合作使命。推文作者Kim预测,在此背景下,Fable-5乃至Anthropic的后续模型重新发布可能需满足重大改动和严格监管。
Browser Use Cloud 基于 Firecracker 重构:嵌套虚拟化下 1 秒启动浏览器
Browser Use Cloud 重建基础设施,让每个浏览器会话在独立的 Firecracker VM 中运行,新会话启动时间不到 1 秒,成本从每浏览器小时 0.06 美元降至 0.02 美元。他们放弃了 Unikraft unikernel 方案,因其自动扩缩容能力不足,曾导致压测使生产环境宕机 45 分钟。新方案选择在普通 EC2...
Google Labs Stitch 24小时产出交互原型
Google Labs 推出 Stitch 工具,并与精英设计机构 Voltage 合作验证其"共同创造"理念。Voltage 为公益组织 Force 4 Good 开发新移动应用,从首次头脑风暴起仅 24 小时内,利用 Stitch 的极速迭代能力,直接交付了完全交互的多屏原型,远超客户原本只期望的几张高层静态模型。
GitHub 发布 CC0-1.0 开源多语言仓库级数据集,覆盖 README、Issue 和 PR
GitHub 推出一个新的仓库级数据集,采用 CC0-1.0 许可证,旨在帮助研究人员和开发者发现跨 README、Issue 和 Pull Request 的多语言开发者内容,加速多语言 AI 开发。
GitHub 发布 CC0-1.0 开源多语言仓库级数据集,覆盖 README、Issue 和 PR
GitHub 推出一个新的仓库级数据集,采用 CC0-1.0 许可证,旨在帮助研究人员和开发者发现跨 README、Issue 和 Pull Request 的多语言开发者内容,加速多语言 AI 开发。
Cloudflare 将更多智能体框架引入平台,以 Flue 为首
Cloudflare Agents SDK 现已成为任何智能体框架均可构建的运行时。Cloudflare 开放了 Agents SDK 原语,Flue 成为首个针对该 SDK 的框架,同时仪表盘中已推出智能体功能。
Cloudflare 将更多智能体框架引入平台,以 Flue 为首
Cloudflare Agents SDK 现已成为任何智能体框架均可构建的运行时。Cloudflare 开放了 Agents SDK 原语,Flue 成为首个针对该 SDK 的框架,同时仪表盘中已推出智能体功能。
智谱 GLM-5.2 在 CritPt 基准上表现突出
智谱发布 GLM-5.2(最大推理努力),在 CritPt 基准(未发表研究级物理问题)上得分 20.9%,与 Claude Opus 4.8 持平,远超其他开放权重模型。DeepSeek V4 Pro 仅得 12.9%;GLM-5.2 同时超越 GPT-5.5、Gemini 3.1 Pro 和 Claude Opus 4.7 等专有模型。仅 GPT-5.5 Pro 以 30.6%...
Women who Code(x)用Codex交付任务智能体与个人指南
上周,我们举办了Women who Code(x) 结果:任务智能体、个人指南,以及许多使用Codex交付的项目。
Claude Design与Replit联动,设计变应用
在Claude中设计。在Replit中构建。 你现在可以将Claude Design中的设计发送到Replit,将其变成一个可工作的应用。
Claude Design与Replit联动,设计变应用
在Claude中设计。在Replit中构建。 你现在可以将Claude Design中的设计发送到Replit,将其变成一个可工作的应用。
AI编码智能体教会机器人安装GPU和剪扎带--NVIDIA GEAR等团队开发ENPIRE框架
NVIDIA GEAR实验室联合卡内基梅隆大学和UC Berkeley开发了ENPIRE框架,让AI编码智能体自主训练机器人。测试了OpenAI Codex(GPT-5.5)、Anthropic Claude Code(Opus 4.7)和月之暗面Kimi Code(Kimi...
Matt Pocock 开源 skills v1:将技能描述 Token 成本降低 63%
Matt Pocock(Total TypeScript 作者)开源了 skills v1,将技能描述的 Token 成本降低 63%。该工具包将技能分为模型可调用和用户可调用,新增 /codebase-design、/domain-modeling、/grilling 三项技能;重写 /writing-great-skills;将 /diagnose 更新为...