RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
glm-5.2 为 Krea-2-Turbo 开发 Gradio 工作流
glm-5.2 在 hf-claude 中,正在为 Krea-2-Turbo 开发一个 gradio 工作流。 🔗 阅读原文:https://x.com/_akhaliq/status/2069921701165453526
谷歌再失 AI 人才,两名 Gemini 核心骨干转投 Anthropic
顶尖AI研究员乔纳斯·阿德勒与亚历山大·普里策尔即将离开谷歌,加入Anthropic。二人为谷歌Gemini大模型研发核心骨干。此前传奇研究员诺姆·沙泽尔离职转投OpenAI,谷歌曾以27亿美元收购其创立的Character.AI并请回主持Gemini研发。数日后,谷歌DeepMind主管、2024年诺贝尔化学奖得主约翰·江珀也宣布跳槽至Anthropic。随着OpenAI与Anthropi...
为什么大型人工智能实验室要招聘这么多哲学家
《经济学人》报道,大型人工智能实验室正在招聘哲学家。该帖在 Hacker News 上获得 101 个 HN Points,引发业界关注。 🔗 阅读原文:https://www.economist.com/science-and-technology/2026/06/24/why-big-ai-labs-are-hiring-so-many-philosophers
自称不用AI者秘密使用
很多人声称从未使用AI,但实际上在秘密使用。 https://papers.ssrn.com/sol3/papers.cfm?abstract_id=5464215 🔗 阅读原文:https://x.com/emollick/status/2069920008293978489
数据推翻 AI 取代论:工程师岗位成科技行业抗风险最强工种
Challenger 数据显示 5 月科技行业裁员创单月新高,AI 是主因。但 SignalFire 追踪 8000 万企业员工轨迹后发布报告称,大型科技企业整体招聘量较 2019 年下降 25%,工程岗位降幅仅 11%;2025 年新入职员工中工程师占比达 55%,高于 2019 年的 46%。初创企业工程师总人数较 2019 年增长 7%。Anthropic 首席执行官曾警示 AI...
Luma AI 逐帧重建《但丁的地狱》
一段指引。一次坠落。 我们最古老的故事之一,逐帧重建。 《但丁的地狱》由 @NinaSabinaAI 创作。使用 Luma 制作。 🔗 阅读原文:https://x.com/LumaLabsAI/status/2069918612479987926
AI处理播客访谈:多稿合并法避免细节遗漏
针对长达3小时播客访谈用AI生成文章时容易遗漏细节的问题,常见做法是连续追问"还有什么细节需要补充?"三次左右(甚至可做成Agent Skill)。但作者采用不同策略:同时让AI生成2-3份稿子,挑选最佳一份作为底稿,再将其它稿子的内容手动合并进来。这样既能避免细节遗漏,也能防止单次生成质量差导致后续追问难以提升质量。 🔗...
NVIDIA 45C冷却设计将数据中心用水量降至接近零
NVIDIA 推出的 45C 冷却设计将数据中心用水量降至接近零,大幅降低水资源消耗。该方案源自 NVIDIA 官方博客。 🔗 阅读原文:https://blogs.nvidia.com/blog/liquid-cooling-ai-factories
Karpathy澄清:非Slack bot,是组织级框架
Karpathy 表示,许多人仅看了标题就做出错误推断和比较,并借机抨击。这东西不是像蹩脚 Slack bot 那样的"功能",也不完全是 Claw(尽管有相似之处),而是一个组织级框架。区别会随时间变得更清晰。SemiAnalysis 回应:这玩意儿就是个 Slack 机器人哈哈。 🔗 阅读原文:https://x.com/SemiAnalysis_/status/2069916559342969272
M3成为Kimchi Coding默认模型
M3 现在已成为 @cast_ai 旗下 Kimchi Coding 的默认构建模型。 并非所有编码任务都应使用同一个模型。Kimchi 根据复杂度、成本及部署需求来路由任务。 这使得 M3 成为自然之选:开放权重、1M 上下文、更强的编码性能且更可控。 文章见评论。 #MiniMaxM3 #AICoding 🔗...
消息称谷歌 Gemini 3.5 Pro 发布时间推迟至 7 月,旨在优化模型性能
据 Business Insider 获悉,谷歌下一代大语言模型 Gemini 3.5 Pro 原定 6 月上线,现推迟至 7 月,以收集更多早期测试用户反馈并进行优化。该模型在 5 月 I/O 开发者大会预告,CEO 皮查伊称将于"次月"发布。部分用户已通过谷歌"Antigravity"平台及 LMArena 进行体验。新模型预计在长文本任务和驱动 AI 智能体方面提升性能,并融入了...
Artificial Analysis 发布 AA-Briefcase 智能体知识工作基准测试
Artificial Analysis 发布 AA-Briefcase 基准测试,测试模型在多周项目语境下生成财务模型、董事会演示等交付物。关键结果:Claude Opus 4.8 平均每任务 23 分钟,得分最高但最慢;GPT-5.5 (xhigh) 仅 11 分钟,效率最高且 Elo 前五;GLM-5.2 得 1261 分耗时 16.3 分钟,为开源模型最佳;MiniMax-M3 得...
Cerebras财报后股价暴跌,CEO称利润率指引被误解
Cerebras上市后首份财报显示一季度营收超预期,但股价周三暴跌近20%。公司预测全年核心业务毛利率38%至41%,低于一季度的47%。CEO Feldman称投资者误解了利润率指引,公司需从一家大客户处租回部分设备以提前释放产能。一季度营收达1.93亿美元,同比增长94%;净亏损从去年同期的2390万美元收窄至1400万美元。 🔗...
OpenAI与Broadcom联合发布定制芯片Jalapeño,专为大语言模型推理设计
OpenAI与Broadcom宣布推出名为Jalapeño的定制ASIC芯片,专为数据中心大规模大语言模型推理设计。该芯片基于OpenAI研究人员提供的洞察及未来模型路线图,研发耗时9个月。早期测试显示其能效显著优于当前最先进方案,但完整性能数据尚未公布,详细技术报告将在未来数月内发布。该项目旨在通过垂直整合降低对Nvidia等外部供应商的依赖,首批芯片计划于今年年底部署到数据中心。 🔗...
聊聊智谱市值破万亿为什么不是高估
作者在自研的硅基骑手参考评测(silicon-rider-bench)中累计测试30个模型,发现智谱GLM系列Agent能力持续进化:GLM-5首次实现反思自身行为并主动少接单提准时率;GLM-5.1首创送顺路单,路径效率低于单次配送理论值;GLM-5.2只需看一次地图便记住全部地点与换电站位置,无需调用`search_nearby_battery_stations()`,大部分tool_c...
GLM 5.2 以 CursorBench 成本跻身 Opus 前沿
GLM 5.2 在 CursorBench 上处于 Opus 前沿(在成本方面),这正是导致前沿实验室利润下降的原因。 🔗 阅读原文:https://x.com/natolambert/status/2069908195611726251
Luma制作粘土动画短片Zozo
卫生纸没了。浴室空了。孩子太安静了。Zozo,一部由Eran May-Raz创作的粘土动画短片。使用Luma制作。 🔗 阅读原文:https://x.com/LumaLabsAI/status/2069907352564769039
Eric Xing论文定义智能体"五维度"框架
Elvis Saravia 推荐一篇试图明确"智能体"定义的论文。Eric Xing 及其同事从哲学与科幻视角出发,分析智能体架构的五维度:目标、身份、决策、自我调节和学习。论文指出,真正"智体性"需这些维度以特定方式组合,从而区分自动化与智能体。论文地址:arxiv.org/abs/2606.23991。 🔗...
GLM 5.2 现已可在 Cursor 中试用
你现在可以在 Cursor 中试用 GLM 5.2! 很高兴看到更多有用的开放模型,感谢 Fireworks 在此合作。我们的评估结果如下 ↓ 🔗 阅读原文:https://x.com/leerob/status/2069904679551611080
Jason Liu 惊叹 @embirico
哇 @embirico 🔗 阅读原文:https://x.com/jxnlco/status/2069904154122961233
Claude Code v2.1.191 发布
Claude Code v2.1.191 新增 `/rewind` 命令,支持从 `/clear` 前恢复对话。修复流式响应时滚动位置跳到底部、后台智能体停止后复活等问题。改进 MCP 服务器可靠性,对 `tools/list` 等请求增加短暂退避重试;优化 OAuth 流程,无头环境直接跳过浏览器弹窗。流式响应 CPU 使用率降低约 37%(通过合并文本更新间隔至...
AI被认为会取代工程岗位,但新数据显示工程是2025年最具韧性的岗位
风投机构SignalFire追踪8000万家公司数百万员工数据发现,工程是2025年最具韧性的岗位。大型科技公司总招聘较2019年下降25%,工程岗仅降11%;工程岗占Alphabet、Meta等12家"Tech Majors"新招员工的55%(2019年为46%)。早期初创公司2025年工程师招聘比2019年增长7%。Anthropic...
AI被认为会取代工程岗位,但新数据显示工程是2025年最具韧性的岗位
风投机构SignalFire追踪8000万家公司数百万员工数据发现,工程是2025年最具韧性的岗位。大型科技公司总招聘较2019年下降25%,工程岗仅降11%;工程岗占Alphabet、Meta等12家"Tech Majors"新招员工的55%(2019年为46%)。早期初创公司2025年工程师招聘比2019年增长7%。Anthropic...
Google Flow Agent 现可基于街景生成图片视频
Google Flow Agent 新增 Google Maps Street View 实景锚定功能,支持根据用户提示中的地名或街道地址,为图片和视频生成提供真实世界细节。用户需启用 Agent 模式并在提示词中包含具体地点。目前该功能仅限美国街景位置可用。 🔗 阅读原文:https://x.com/testingcatalog/status/2069901740015579588
Artificial Analysis 举办 Intelligence Index 活动,发布 v4.1 与新基准
Artificial Analysis 宣布将于 6 月 29 日(周一)在旧金山举办 Intelligence Index 活动。演讲嘉宾来自 Google DeepMind、NVIDIA 和 Z AI。活动将介绍 AI Intelligence Index v4.1 更新以及新推出的长时知识工作基准 AA-Briefcase。 🔗...
AI研究员持续从Google流向竞争对手
据Bloomberg报道,顶尖AI研究员Jonas Adler和Alexander Pritzel离开Google加入Anthropic,二人曾参与Gemini模型开发。上周,传奇研究员Noam Shazeer(曾创立Character.AI,后Google通过收购将其带回)宣布离开Google加入OpenAI。几天后,Google DeepMind总监John...
前高盛高管Raoul Pal:智能体AI将吞噬传统软件/SaaS
前高盛高管Raoul Pal在访谈中指出,若产品仅是软件,智能体AI可随时复刻、优化并重新部署。他将智能体AI比作专家网站Fiverr,能自动完成建站、编码、域名注册、品牌策划、营销及邮件列表等全流程。他设想用户只需对AI说"把Steven的网站做得更好",AI便能在3分钟内完成。这引发了关于AI将吞噬软件、软件创业者未来出路的讨论。 🔗...
内存芯片短缺持续到2027年,美光季度营收翻四倍至414.5亿美元
美光(Micron)周三收盘后公布第三财季财报,营收同比翻四倍至414.5亿美元,利润从18.8亿美元增至282亿美元。公司预测第四财季营收介于490亿至510亿美元。美光还与AI公司Anthropic签署内存和存储芯片供应协议,并参与了Anthropic的H轮融资(未披露投资额)。AI热潮导致的内存芯片短缺预计将持续至2027年,苹果CEO库克一周前已警告产品涨价不可避免。 🔗...
AI 行业商业化的本质可能是 2boss
AI 行业商业化的核心是"2boss"--付费方不是使用者(程序员、抽卡员),而是他们的老板。以 Claude/Codex 和 Seedance 为例,老板愿为提升效率的工具付费。中国 2B 市场进入"2boss"时刻,老板买单意愿强烈;独立开发者等自费者也扮演自己的老板。 🔗 阅读原文:https://x.com/oran_ge/status/2069895919034929266
Claude 频道工作采用智能体身份凭证
当 Claude 与四人一同在频道中工作时,它使用谁的凭证? 答案:它自己的。标注 Claude 时,Claude 会像其他队友一样被配置,拥有自己的凭证。 我们将这种访问模型称为"智能体身份"。其工作原理如下: 🧵 🔗 阅读原文:https://x.com/ClaudeDevs/status/2069895377080443271