RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
卡兹克推荐10本AI时代必读好书:无一直接谈AI,底层能力决定使用水平
卡兹克分享10本对理解AI极有帮助的书,但无一直接关于AI技术。他强调决定AI使用水平的是底层能力,而非工具技巧。书单包括:凯文·凯利《失控》(1994年,核心概念"涌现"--大量简单个体协作产生复杂智能);维纳《人有人的用处》(1950年控制论之父提出"反馈"是人机协作核心);梅多斯《系统之美》(警惕"舍本逐末"--用AI替代思考导致能力存量流失);罗斯林《事实》(用数据思考避免情绪化决策...
Transformer 核心作者 Noam Shazeer 加入 OpenAI
Transformer 核心作者 Noam Shazeer 宣布加入 OpenAI。2021 年他因谷歌拒绝发布其聊天机器人而离职创办 Character.AI;2024 年谷歌以约 27 亿美元技术许可协议将其请回,他担任 Gemini 技术负责人。此次离职后 OpenAI 与 xAI 均参与争抢。Shazeer 是《Attention Is All You Need》主要作者,发明了...
Codex推iOS构建插件:浏览器预览与热重载
OpenAI 的 Codex 新增"Build iOS Apps"插件,可内嵌浏览器运行应用、打开 SwiftUI 预览、热重载编辑,全程无需离开 Codex,告别复制-粘贴-构建-截图的循环。Greg Brockman 称这是构建 iOS 应用更好方式。
swyx 的 Midjourney 医疗产品发布现场笔记
swyx 记录 Midjourney 医疗产品发布,与会者将其比作初代 iPhone 和特斯拉发布。该产品旨在将医学成像质量提升 40-100 倍,实现"扫描器官像称体重"。Midjourney 仅以每年 1000 万美元研发预算支撑这一创新,质疑其他机构的研发效率。今年 MJ 另有 7 个副项目计划发布。Nature 论文及 biohub 播客佐证更好数据驱动更好科学。swyx...
阿里开源首个统一科学大模型 LOGOS,仅用 1/56 参数超越微软 NatureLM
6 月 18 日,阿里 ATH-Token Foundry 联合人大高瓴人工智能学院开源首个基于统一"科学语法"的多领域科学生成基础模型 LOGOS。LOGOS-1B 仅用 1B 参数量(1/56)在多个任务上超越微软 NatureLM(8×7B)。模型构建涵盖 7 类模态、共 44.87B tokens 的预训练语料,通过共享词表将蛋白质、小分子等异构对象编码为统一离散 token...
Noam Shazeer出走OpenAI,Gemini前景蒙尘
两年前Google以27亿美元请回的AI传奇人物Noam Shazeer,现已离职加入OpenAI。多位DeepMind内部人士称Noam曾拯救Gemini,甚至有传说他仅修改几行训练代码就使模型质量瞬间跃升。尽管有这般贡献,Gemini的编程能力仍显落后。作者对Gemini的未来感到不确定,希望它能重返昔日辉煌,强调行业需要更多模型选择。
英国监管机构要求谷歌整改:限期6个月提高搜索算法透明度
英国竞争与市场管理局(CMA)依据2025年数字竞争框架,限期6个月要求谷歌全面整改搜索排名系统。所有自然搜索结果必须基于客观、非歧视的标准,AI概述功能也不得偏袒任何平台。CMA同时要求谷歌建立更透明的内部投诉处理流程,并允许用户将个人搜索数据安全迁移至第三方。谷歌需在3个月内完成数据可移植性架构。谷歌发言人回应称其排名系统已公平透明,但将配合监管。
路透社:Google Gemini 联合负责人 Noam Shazeer 离职加入 OpenAI
路透社消息,Google Gemini 联合负责人 Noam Shazeer 将离开 Google 加入 OpenAI。他是 Transformer 时代最重要的模型构建者之一。Google 曾于 2024 年支付 27 亿美元从 Character.AI 将其与团队带回,并让他负责 Gemini 项目。Shazeer 在推文中表示期待加入 OpenAI,并对 Google...
OpenAI靠Codex 5.6重置额度留用户
OpenAI 现在是新模型 GPT-5.6 迟迟不能及时发布。 靠在 Codex 5.6 疯狂重置额度来做用户留存😄 不也是一个不错的办法,对于用户来说也挺好。 毕竟叼毛 Claude 可不会给你这种甜果吃啊~
支持中文:Claude 语音模式酝酿升级,新图标暗示通话式 AI 交互
Anthropic 正升级 Claude 的语音模式,新增西班牙语、中文、日语、德语、葡萄牙语、俄语和乌克兰语等语言选项,打破仅支持英语的限制。语音交互引入两种模式:原有的免提模式支持连续对话,新增按下通话模式需按住按钮说话、松手发送语音消息。iOS 版 Claude 应用出现类似电话听筒的新图标,外界猜测可能为更接近通话的语音交互做准备。
京东 JoyInside 孵化"小龙 AI 魔法益智打印机"30天上架,618开门红4小时销量环比增长17倍
京东 JoyInside 硬件创新大赛孵化的"小龙 AI...
Midjourney Medical 推出全身超声波扫描仪及 Spa 计划
Midjourney CEO David Holz 展示了首款硬件 The Midjourney Scanner,一款基于超声波的全身扫描仪。设备采用环形传感器阵列,通过水下传感器从多角度发送超声波,约 60 秒完成扫描,捕捉肌肉、脂肪、骨骼等垂直切片。与 Butterfly Network 合作,每台搭载 40 个成像模块及 2 petaflops 处理能力,Holz...
cuTile Rust:安全无数据竞争的 GPU 内核系统
cuTile Rust 是一个基于 tile 的 GPU 编程系统,允许用 Rust 编写内存安全、无数据竞争的内核。它通过 `#【cutile::module】` 宏将内核 AST 嵌入主机二进制,在运行时经 CUDA Tile IR JIT 编译为 GPU cubin。可变张量在启动前分割,不可变张量共享,启动器在 GPU 工作期间保持所有权。在 NVIDIA B200...
Midjourney 超声 CT 扫描仪
Midjourney 宣布进军医疗领域,开发基于水下超声波的新型扫描仪。用户站在平台上缓慢下降(每秒约2英寸),经过由50万个微型方块组成的环,每个方块同时作为扬声器和麦克风,每秒产生TB级数据。数千台计算机将声波变化重建为亚毫米级3D图像,单次扫描仅需60秒。同时计划开设Midjourney水疗中心,将扫描融入日常休闲体验。未来将优化算法与硬件,并建设首个研究型水疗中心。
cuTile Rust:安全无数据竞争的 GPU 内核系统
cuTile Rust 是一个基于 tile 的 GPU 编程系统,允许用 Rust 编写内存安全、无数据竞争的内核。它通过 `#【cutile::module】` 宏将内核 AST 嵌入主机二进制,在运行时经 CUDA Tile IR JIT 编译为 GPU cubin。可变张量在启动前分割,不可变张量共享,启动器在 GPU 工作期间保持所有权。在 NVIDIA B200...
李飞飞谈空间智能前沿,UCSD黄碧薇创Aether AI推因果世界模型
李飞飞在YC访谈中称"空间智能是AI下一个前沿",要求世界模型超越像素和语言,捕捉3D结构。现有VLA模型仅学统计相关性,物理场景易失败(如桌子高2cm即翻车)。UCSD黄碧薇在CVPR 2026提出因果世界模型框架,并宣布旗下Aether AI融资2000万美金,为全球首个因果世界模型公司。她拥有12年因果AI研究(CMU PhD,causal-learn作者,100+顶会论文)。
华为昇腾 0 Day 支持智谱 GLM-5.2 模型,提供全面推理优化
昇腾 A3 系列已全面支持 GLM-5.2 单双机及大 EP 推理部署,围绕 MOE 大融合算子、通信计算融合、注意力前处理与多 Token 预测、高并发调度与预填充延迟、智能缓存与索引优化、PD 分离与 Prefix Cache 等关键技术进行高效推理优化。GLM-5.2 在 Code Arena 全球盲测中获可用模型第一;专为长程任务设计,支持 1M 上下文,表现介于 Claude...
蚂蚁百灵与 SGLang 团队合作优化 Ling-2.6-1T 在 TPU v7x 上的部署
蚂蚁百灵与 SGLang 团队合作,将 1T 参数的混合 MoE 模型 Ling-2.6-1T 通过 SGLang-JAX 部署至 TPU v7x。优化包括:升级 Fused MoE V2 内核(token 和累加器驻留 VMEM,双缓冲专家权重,隐藏路由与预取);混合内存池(10 个全注意力层 per-token MLA KV + 70 个 GLA 层 per-request...
Noam Shazeer 加入 OpenAI
我很激动地宣布,我将加入 OpenAI,并期待与那里卓越的团队合作。 这是一个艰难的决定。我为 Google 的出色团队以及我们共同构建的一切感到无比自豪。能与你们所有人共事是我的荣幸和快乐。 (主推文:"we are sota in noams")
Anthropic CEO:推迟Mythos发布损失惨重
"我们因为不发布这个模型遭受了巨大的商业损失。这个模型在Anthropic内部极大地加速了研究以及后续模型的开发。如果我们将其发布,它也会在外部世界起到同样的作用。这使我们在商业上遭受了巨大的损失。"
Midjourney发布全身超声波CT扫描仪
Midjourney 预热数日的硬件设备竟是一款医疗设备:全身超声波计算断层扫描仪。该设备使用 8,960 个独立传感器环绕人体排列,运动分辨精度达皮米级别。初代原型机比 MRI 便宜 10 倍、快 60 倍,且无辐射。Midjourney 还计划开设 Spa 店,用户只需泡澡即可完成全身检查。
首个统一科学大模型 LOGOS 正式开源
LOGOS 由 ATH-Token Foundry 联合中国人民大学高瓴人工智能学院开源,是首个基于统一"科学语法"的多领域科学生成基础模型。LOGOS-1B(1B参数)在六大科学任务上匹配或超越领域专用方法:口袋条件配体生成纯序列范式首次超越3D扩散模型,超越NatureLM(8×7B);逆合成预测Top-1准确率74.8%;口袋位点识别仅靠序列达58.5%...
首个统一科学大模型 LOGOS 正式开源
LOGOS 由 ATH-Token Foundry 联合中国人民大学高瓴人工智能学院开源,是首个基于统一"科学语法"的多领域科学生成基础模型。LOGOS-1B(1B参数)在六大科学任务上匹配或超越领域专用方法:口袋条件配体生成纯序列范式首次超越3D扩散模型,超越NatureLM(8×7B);逆合成预测Top-1准确率74.8%;口袋位点识别仅靠序列达58.5%...
阿里云AI视频计划新用户半价
预付费更多,解锁AI视频节省计划的更大优惠。 限时活动,新阿里云用户享受AI计划50%折扣。 立即解锁AI节省:https://int.alibabacloud.com/m/1000414529/
OpenAI 发布 LifeSciBench:750 项专家编写任务的生命科学研究基准
OpenAI 推出 LifeSciBench,包含 750 个由博士级科学家编写的任务,覆盖 7 个工作流和 7 个生物领域。每个任务配有提示、支撑材料及 19,020 条原子化评分标准,约 79% 的任务需多步推理(平均 4 步)。评估五个模型中,领域专用模型 GPT-Rosalind 通过率 36.1% 领先,其后 GPT-5.5 为 25.7%、Gemini 3.1 Pro 为...
美国司法部保护 xAI 密西西比州 AI 数据中心,视为国家安全基础设施
美国司法部近日保护 xAI 位于密西西比州的 AI 数据中心,认为高速 AI 基础设施属于美国国家安全基础。司法部将 Grok 及其系统视为关键技术而非普通消费软件,因先进模型可支持国防行动。此举反映政策转变:美国不希望战略 AI 工作负载依赖脆弱供应链、缓慢审批流程或外国控制算力。AI 算力正成为国防资源,可用电力、数据中心规模、模型能力与运营准备度紧密关联。