RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
MiniMax 发布 MSA 稀疏注意力方法,开源推理内核并推出 MiniMax-M3 模型
MiniMax 发布 MSA(MiniMax Sparse Attention),一种构建在 Grouped Query Attention 上的稀疏注意力方法。它将注意力分解为索引分支与主分支:索引分支以块粒度(默认 128 token)为每个 GQA 组选择 16 个 token 块(固定预算 2048 个键值 token),主分支仅在这些块上执行精确 softmax 注意力。MSA...
阿里云法国新云区域上线,双可用区
🇫🇷 阿里云在法国推出新云区域,设有巴黎双可用区。 作为我们在欧洲(继德国和英国之后)的第三个基础设施中心,新区域通过本地托管的云服务帮助企业扩展创新,并为即将推出的智能体AI服务铺平道路。 🔗: https://int.alibabacloud.com/m/1000405058/ #AlibabaCloud #France #AI #CloudComputing #AgenticAI
Claude Code 用户画像:平均每周使用 20 小时,AI 代码修改占 26%
Anthropic 6月16日发布博文,分析2025年10月至2026年4月约23.5万用户的40万次Claude Code会话。用户平均每周使用20小时,其中代码修改占26%,代码编写占25%,合计超半数。典型会话中人类负责约70%规划决策,Claude完成约80%执行决策。新手(1级)每次提示产生约5个操作和600个单词输出,专家(5级)产生2倍操作和5倍输出(约3200个单词)。
算苗科技 3D TokenPU 芯片正式流片:3D 混合堆叠架构,全流程国产化
算苗科技于6月15日宣布旗下全国产自研3D TokenPU芯片正式流片。该芯片采用3D混合堆叠架构,通过多层晶圆垂直堆叠缩短存储与计算单元的数据传输路径,搭载16TB/s带宽,面向大模型线上推理场景优化。芯片从架构设计到流片制造均依托国内产业链完成,适配通用大模型、多模态生成、实时对话等高负载推理任务,补强了国内高端AI算力硬件的自主供给能力。
Z ai 发布 GLM-5.2:开源权重新 SOTA,智能指数 51 分排名第四
Z ai 推出 GLM-5.2,在 Artificial Analysis Intelligence Index 上得 51 分排名第四,成为开源权重 SOTA。模型规模同 GLM-5.1(744B 总/40B 活跃参数),智能指数 v4.1 提升 11 分。科学推理显著增强:CritPt +16% 至 21%,HLE +12% 至 40%,GPQA Diamond +3% 至...
极摩客预热 EVO-X3 迷你主机:全金属立式刀锋设计,锐龙 AI Max+ 395 处理器
极摩客6月17日预热EVO-X3迷你主机,采用立式刀锋设计,全金属机身,搭载AMD锐龙AI Max+ 395处理器,支持128GB LPDDR5X-8000内存,提供2个M.2 SSD硬盘位,配有原生OCuLink接口、Wi-Fi 7和USB4。该机将于6月22日在电商平台开启预约。此外,极摩客还将推出内置Claw"龙虾"自托管网关的4TB存储"机皇版"。
TRAE AI创造力大赛:总奖金100万,无门槛参赛
TRAE 推出"AI 创造力大赛",总奖金高达 100 万元。比赛对参赛者没有任何编码、职业等限制,任何人都可参加。进入决赛保底获 1 万元现金,冠军 30 万、亚军 20 万、季军 10 万,另设赛道大奖和社会公益特别奖各 5 万元。全程 token 消耗由赛事权益覆盖。报名即送 99 元速通 Pro 月卡和决赛现场门票。
ChatGPT 语音最大规模升级:OpenAI 正筹备推出 GPT-Bidi-1 模型
OpenAI 正筹备推出 GPT-Bidi-1 模型,采用双向(BiDi)架构,能同时听和说,吸收用户打断并在对话中实时调整。相比已进化至 GPT-5.5 的文本模型,ChatGPT 的语音能力仍基于较旧音频技术栈,GPT-Bidi-1 旨在弥合这一差距。上线后用户可切换双向模式与现有高级语音模式,并支持 High、Medium 及 Instant 智能等级,按任务调整速度和深度。
证监会主席吴清:积极支持人工智能企业上市
6月17日,中国证监会主席吴清在2026陆家嘴论坛上表示,科创板将扩大第五套标准适用范围至人工智能大模型领域,以支持AI企业上市。同时,将支持量子科技、生物制造、具身智能等硬科技企业在科创板上市,并有序推进创业板改革,加大对新型消费、现代服务业的支持力度。
Kilo Code 展示多智能体编码实践
看看 Kilo Code 如何扩展多智能体编码!💻 加入 Kilo.ai 增长主管 Job Rietbergen,参加阿里云 VivaTech 2026,获取真实生产环境洞察。 🔗 注册:https://int.alibabacloud.com/m/1000414352/
Grok Imagine 1.5 复刻权游演讲实测惊艳
Grok Imagine Video 1.5 实测: 复刻《权力的游戏》Tyrion 经典法庭演讲,效果真的有点吊炸,完全不输seedance 2, 整个场景真实感、物理表现和原生音频都拉满了……面部微表情、布料动态、火把光影互动都很自然
GLM-5.2 发布:AAI 指数 51 分,开源权重模型新标杆
Z ai 发布 GLM-5.2(744B 总参数/40B 活跃参数),在 Artificial Analysis Intelligence Index v4.1 上得分 51,超越 MiniMax-M3、DeepSeek V4 Pro 和 Kimi K2.6。科学推理大幅提升:CritPt +16、HLE +12、GPQA Diamond 达 89%。GDPval-AA v2 得分...
韩国兴起"多巴胺网站":模拟点餐、购物缓解焦虑
韩国年轻人开始光顾"多巴胺网站",通过模拟点餐、购物等日常琐事缓解焦虑。有人使用虚假外卖平台,模拟翻看菜单、添加购物车、点击"下单"获得满足感。推特用户@malheeelife今年五月借助ChatGPT搭建了同类韩语模拟网站,配有星级评分和购物车。同期英文应用FakeEats上线,设有等级奖励和AI生成的宣传资料。还有网站让人假装和别人一起抽烟休息,无需真抽和线下见面。Jungwon大学教授...
Claude Code之父谈"少即是多":CLAUDE.md越短越好
Claude Code之父分享团队核心理念:CLAUDE.md越短越好,他自己的仅两行(提PR自动合并、发审批频道),并建议定期清空重写。模型能力每代都在飞涨,人为堆配置、做UI很快会过时,因此坚持CLI而非GUI。终端输出在详细与简洁间通过用户反馈迭代(支持verbose模式)。用AI修bug已很高效,能自行分析heap dump。核心观点是做减法、保持轻,并不断推翻过时使用习惯。
Anthropic搁置Claude Agent SDK Token计费变更
Anthropic暂停Claude Agent SDK按API Token计费变更计划。该开源SDK允许通过Python或TypeScript调用Claude...
给 Agent 留的指定"办事钱包":微信支付 AI 专属卡发布,实现从智能推荐到下单支付的自动化消费
微信支付正式发布 AI 专属卡,授权接入 Agent 后,用户只需在对话中提出消费需求,即可体验从智能推荐到下单支付的自动化消费。目前已支持在 WorkBuddy 里使用美团服务(Mac 端升级至 5.1.1 即可体验),未来将支持更多平台。安全方面,AI 专属卡与微信支付主账户完全隔离,余额由用户设定并可随时调整,每笔订单需用户最终确认才能完成支付。
Anthropic CEO白宫沟通失败:技术团队需懂人情而非纯技术
近日,Anthropic CEO Dario Amodei与白宫沟通失败,引发业内反思。技术团队与权力对话存在两套语言体系:技术方讲逻辑、安全、长期价值,对方讲立场、交易、国家安全优先级。业内建议关键谈判应派懂人情、能读空气、擅长建立信任的人出席,而非纯技术团队。AI时代技术门槛将拉平,真正的竞争力在于搞定人和建立信任--技术决定产品上限,沟通决定产品生死。
谷歌推送 Wear OS 7:续航提升10%、引入实时更新与Gemini AI
6月17日,谷歌向Pixel Watch 2、3、4正式推送Wear OS 7更新。系统功耗优化使续航比Wear OS 6提升10%。交互新增手机端"实时更新"功能,可追踪外卖、快递状态;无手机时可通过音频切换器管理音乐播放。智能方面,部分2026年发布的手表将获Gemini Intelligence支持,能理解指令、调用应用完成多步骤任务,支持语音创建定制化小部件,并可调用Google...
OpenAI 提出 Deployment Simulation 预部署安全方法
OpenAI 提出预部署安全方法 Deployment Simulation,通过重放历史对话并用候选模型重新生成助手回复来模拟部署行为。该方法可估计每 20 万条消息中出现次数低于 1 次的非尾部风险,并在 GPT-5.4 Thinking 等模型上验证。OpenAI 分析了约 130 万条去标识对话(2025 年 8 月至 2026 年 3 月),测得中位数乘法误差 1.5×,尾误差约...
智谱GLM-5.2开源,1M上下文,称可比肩Opus 4.8
智谱发布GLM-5.2,开源模型(MIT许可),在编码和智能体任务上有显著提升,支持1M上下文窗口。提供两种推理努力级别:GLM-5.2 (max) 极限模式、GLM-5.2 (high) 性能与token效率平衡。API定价与GLM-5.1保持不变。官方评测显示其性能已可与Opus 4.8竞争。
Grok Imagine 1.5 Fast 视频生成速度翻倍
Grok Imagine Video 1.5 Fast 的视频生成速度几乎翻倍。 它可在约25秒内生成一段6秒720p视频,而上一代模型需要40秒以上。 这是一次巨大的速度升级。 以下是对比:
泄露的 OpenAI 财务数据显示亏损 385 亿美元,计算资源消耗巨大
一份据称泄露的 OpenAI 财务数据被公开,显示该公司亏损达 385 亿美元,同时计算资源(compute)消耗极为巨大。该信息源自 runtimewire.com 的报道,并在 Hacker News 上引发热议,获得 128 个点赞。目前尚无官方回应,但数据揭示了 OpenAI 在维持大模型训练与推理过程中面临的巨大成本压力。
阿里云VivaTech 2026聚焦AI智能体重塑商业
AI智能体如何重塑商业?🌐 加入我们在阿里云VivaTech 2026的精英小组,成员来自阿里云、ElevenLabs、Eden AI、Storyverse AI 和 Firecrawl。 🔗 立即注册:https://int.alibabacloud.com/m/1000414352/
Vibecon明日纽约Canyon开幕
明天。Vibecon。Canyon, 纽约。 如果你要来,我们现场见。如果不来……门票仍在 http://vibecon.ai
消息称 OpenAI 今年一季度现金消耗达 37 亿美元,超同期收入的一半
OpenAI 在 2026 年第一季度现金消耗达 37 亿美元,超过同期 57 亿美元收入的一半。数据来自一份向股东披露的文件,直观体现 AI 大模型研发与规模化落地的巨额成本。OpenAI 正筹备上市,已在美国保密递交 IPO 申请,最早或于 9 月完成,估值最高可达 1 万亿美元。头部 AI 企业持续重金投入算力、模型研发与人才招募以维持竞争优势。
消息称 OpenAI 今年一季度现金消耗达 37 亿美元,超同期收入的一半
OpenAI 在 2026 年第一季度现金消耗达 37 亿美元,超过同期 57 亿美元收入的一半。数据来自一份向股东披露的文件,直观体现 AI 大模型研发与规模化落地的巨额成本。OpenAI 正筹备上市,已在美国保密递交 IPO 申请,最早或于 9 月完成,估值最高可达 1 万亿美元。头部 AI 企业持续重金投入算力、模型研发与人才招募以维持竞争优势。