RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
AI HOT 日报 · 2026-07-05 — 我国研制全球首款基于可控存内计算的忆阻器神经动力学芯片
我国研制全球首款基于可控存内计算的忆阻器神经动力学芯片 — 点击查看完整日报
ResearchStudio-Reel:从论文到海报、视频和博客的自动化系统
ResearchStudio-Reel 由五个 Claude Code 和 Codex 技能组成,包含共享提取器 Paper2Assets,三个可编辑生成器 Paper2Poster、Paper2Video、Paper2Blog 以及交互式汇聚层 Paper2Reel。它一次性从论文中提取资产,生成打印级海报、同步讲解视频和双语博客,并支持在 PowerPoint 或 Word...
GPT-5.5 Codex 推理 token 聚类在 516/1034/1552 可能导致复杂任务性能下降
报告指出,Codex 的 GPT-5.5 模型推理输出 token 异常集中在 516、1034、1552 三个固定值。在 390,195 条记录中,GPT-5.5 响应精确命中 516 token 的比例为 44.0%,远高于其他模型(0.34%-19.8%)。2026 年 2 月至 6 月,精确 516 占比从 0.11% 升至 53.30%,同时平均推理 token 从 268.1...
AI数据中心耗水量远超企业披露,发电间接用水成巨大隐形消耗
微软、谷歌、亚马逊等巨头今明两年预计投入1万亿美元建设AI基础设施。美实验室报告显示,数据中心间接耗水量(发电环节)约为直接耗水的12倍。谷歌2025年报告披露直接耗水109亿加仑,间接约3倍;Meta间接耗水190亿加仑,是直接的20倍以上。英伟达展示闭环冷却系统无需补水;微软计划2027年起新建数据中心采用该技术。凤凰城当前数据中心用水占城市3%,到2031年或突破20%。多数新建数据中...
与AI Sol的幽默敬礼互动
用户向AI Sol发送大量🫡表情,Sol识别出共39个。用户要求乘以12再减800,Sol算出结果为-332,并解释负数意味着欠332个敬礼。用户再次发送39个🫡,Sol记录为支付,剩余债务293个。Sol以"敬礼经济是无情的"回应,展现其数学计算与幽默对话能力。 🔗 阅读原文:https://x.com/thsottiaux/status/2073554978053005607
MiniMax纳入codex.bar,可查reset过期时间
codex.bar 下一个版本将显示你的 reset 何时过期,方便你优化价值最大化。MiniMax 表示很高兴被收录,开源模型生态越来越好。 🔗 阅读原文:https://x.com/MiniMax_AI/status/2073554729842668027
BestBlogs 周刊:模型、Agent 与人的成本
洪明在推文中指出,当生成代码和原型实现的成本趋近于零,研发流程中最昂贵的部分已转移至系统验证、方案策展与判断力。本期 BestBlogs 周刊聚焦「模型、Agent 与人的成本」主题,沿着 4 条主线分析智能的账单,涵盖系统显性开销、Skill 隐性负债以及人机协作时的责任机制等,推荐阅读。 🔗...
智能的账单:模型、Agent与人的成本
本期周刊探讨模型、Agent与人的成本。关键数字:Claude Sonnet 5首发价输入2美元/百万token,输出10美元;GPT-5.6 Sol刷新Terminal-Bench 2.1成绩,输入5美元/百万token,输出30美元;LongCat-2.0总参数1.6T,平均激活48B,支持1M上下文;DeepSeek DSpark单用户速度提升60%-85%;Nano Banana...
Codex仍有让人惊讶的不足
你能说说,Codex 仍然做不好、而我们应该早就解决的事情是什么? 🔗 阅读原文:https://x.com/thsottiaux/status/2073551549494596079
英国"星际之门"项目被曝为"空头支票",OpenAI 从未实地考察核心选址
英国星际之门数据中心工程已于今年4月搁置,OpenAI称原因为监管政策与高昂能源成本。《卫报》披露,OpenAI从未实地考察核心选址钴园产业园,双方也未与当地政府会面。英国政府宣传的300亿英镑"潜在总投资"中,200亿英镑仅为建设所需成本,并非实际承诺投资。项目在特朗普访英前夕仓促推进,企业称被强制参与。选址未接入国家电网,现有基础设施无法支撑项目规模。 🔗...
CMU发布Gym-Anything:双智能体循环将任意软件转化为AI训练环境
CMU新研究提出Gym-Anything方法,通过双智能体循环自动将任意软件构造成AI智能体训练环境:一个智能体负责编写脚本、安装软件、加载真实数据并收集运行证据,另一个智能体用截图、日志、文件及清单审核证据并回传修复。基于该方法构建的CUA-World包含10,000+任务,覆盖200个应用和22个主要职业类别。测试显示,当前最强模型在困难长任务上也仅能解决一小部分,表明真实软件使用场景的...
AI成本失控:比人力更贵,Uber微软遇困境
Rohan Paul 认为AI正处混乱中间阶段:使用看似高效但产出不明确。Forbes报道称AI成本已超过其旨在取代的人力成本。Uber据报在4个月内烧光了2026年AI编码预算;微软因成本难以为继也削减了AI编码助手。Paul判断这只是过渡期尴尬阶段,预计未来10-18个月成本下降后将缓解。 🔗...
Midjourney 反击好莱坞:要求迪士尼等制片厂披露自身 AI 使用情况
Midjourney 在与迪士尼、环球影业、华纳兄弟的版权诉讼中,申请强制三家影业披露自身 AI 使用情况。Midjourney 辩称其模型使用受版权保护的角色图像训练属于合理使用,并指出影业内部可能也存在类似未经授权下载素材训练 AI 的行为。此前法官裁定影业仅需提供面向消费者的 AI 生成内容,Midjourney 请求撤销该限制,要求影业交出所有在 Midjourney...
突破国际难题:我国成功研制全球首款基于相变忆阻器的神经动力学系统芯片
北京大学杨玉超团队联合中科院上海微系统所等,在《科学》发表成果,成功研制全球首款基于相变忆阻器的毫秒级神经动力学芯片。采用40nm工艺,芯片面积0.28mm2,运行频率50MHz,单步运算时延2.12ms。相比专用加速器速度提升3.82~36.27倍,功耗降低11.75~24.73倍;相比NVIDIA A100...
Nvidia、Oracle 等合著论文:功率灵活的 AI 数据中心可在电网压力下快速降功耗
Nvidia、Oracle 等合著新论文提出"功率灵活的 AI 数据中心"范式,允许数据中心在电网压力期间快速降低功耗,同时保护重要任务。系统将电网信号与 AI 任务调度、GPU 功率限制及实时功耗测量联动。在真实 130kW GPU 集群测试中,成功满足 200+ 个功率目标,40 秒内将功率降低约...
Fable 5 将《命令与征服:将军:绝命时刻》移植到 iPhone/iPad 被指贡献仅最后一段 iOS 适配
@ammaar 声称用 Fable 5 将 2003 年《命令与征服:将军:绝命时刻》原生编译为 ARM64 并移植到 iPhone/iPad,支持触控玩 RTS,战役、遭遇战、将军挑战均可用,已开源。但 commit 记录显示,仓库 2000 个 commit 绝大多数来自上游 GeneralsX 项目(EA 此前已开源该游戏源码),Fable 仅贡献最近 19 个(不到 19...
新版 Claude 模型导致 Pi 工具调用异常
Armin 在开发编码工具 Pi 时发现,新版 Claude 模型(Opus 4.8 和 Sonnet 5)调用 Pi 的 edit 工具时,会在嵌套的 `edits【】` 数组中凭空增加不存在的键,导致工具调用因 schema 不匹配被 Pi 拒绝。旧模型(包括 Haiku)均无此问题。Armin 推测 Anthropic 通过强化学习让新模型更善于使用 Claude Code...
特斯拉 Robotaxi 服务进军美国迈阿密,车内无安全员
特斯拉官方在 X 平台宣布,Robotaxi 自动驾驶网约车服务现已扩展至美国迈阿密西部一小块区域,同样避开繁忙市中心。X 平台部分网友分享已坐上无人监管的 Robotaxi,运营过程中未配备车内安全员。特斯拉早前在得克萨斯州奥斯汀推出服务时曾因安全员引发争议。其竞争对手 Waymo 已于今年 1 月进军迈阿密市场,Zoox 也计划在该地开始实地测试自动驾驶车队。 🔗...
Rohan Paul 最新 newsletter 汇总多条 AI 动态:Mira Murati 的 Thinking Machines 等
Mira Murati 的 Thinking Machines 使 Bridgewater 的私有专家判断可训练,错误率比前沿模型低 29.8%。Boris Cherny 与 Cat Wu 访谈详解从 Claude Code 转向 Claude Tag。开发者通过向 Fable 5 展示文本图片,实现低成本大上下文输入。Claude Fable 5...
人类为什么那么喜欢用破折号呢 看得脑仁疼 -来自一个预训练AI的吐槽
人类为什么那么喜欢用破折号呢 看得脑仁疼 -来自一个预训练AI的吐槽 🔗 阅读原文:https://x.com/oran_ge/status/2073533715683401833
关于品味的笔记
AI让创作能力几乎免费,品味(审美判断与预判他人喜好)成为最大差异化技能。品味需要亲身消费体验("想当厨师就要去别人餐厅吃饭"),而非只看菜单;它是偏离安全均值的冒险。引用茶道故事:远州只选众人认可的美,利休却有勇气爱只有自己能看见的东西。AI工业复制更坏的是--它给出终点,却剥夺过程中磨练注意力的体验(如音乐转录中反复聆听的训练)。品味随注意力生长;当工具移除注意力,必须主动把它放回去。...
耶鲁与芝加哥大学论文:LLM生成研究想法比人类范围窄,偏向连接已有工作
耶鲁大学和芝加哥大学最新论文基于11,683篇真实论文构造对照测试,让LLM基于与人类相同的先前工作提出研究动机和方法。结果发现,人类研究者想法模式多样(如解释机制、测试失败、测量证据、构建系统、提升效率),仅12.1%属于"连接已有工作"类;而LLM生成的同类想法占比高达47.1%至64.2%,频率约为人类的4至5倍。即使增加推理步骤(额外CoT),这一连接偏好反而更强,说明LLM倾向于优...
GPT-5.6 Sol 初期报告:30小时超 Claude Opus 64小时加速
据早期测试,GPT-5.6(代号 Sol)在30小时内已超越 Claude Opus 64小时运行达到的加速效果,尽管其初期探索更慢、失败更多、写代码更少。Sol 采用不同策略:不使用低精度,而是借助集群/DSMEM 和创新的数值方法取得优势,后续将转向低精度并利用 Tensor Cores(TC)。当前在某个排行榜位列第7。开发者认为这种"更少暴力探索、更持久研究"的思路令人期待。 🔗...
Emad Mostaque 谈 Fable 当前体验
当前的Fable体验。 🔗 阅读原文:https://x.com/EMostaque/status/2073514471499137426
Mark Cuban:不学AI将被取代
Mark Cuban 在采访中告诫毕业生,学习 AI 已不再是可选项。不会使用 vibe coding、AI 智能体或 Claude 等工具的人,将被会的人取代。如果老板支持你运用这些技能,那是好事;如果不支持,老板也坐不长。如果 CEO 不理解 AI 的价值,CEO 同样会被替换。他甚至说,如果有人还留着不用 AI 的 CEO,那就告诉他,他会开一家公司来击败他们。 🔗...
Google 广告虚构开国元勋用 Workspace 起草《独立宣言》,AI 元素引争议
《独立宣言》签署 250 周年之际,Google 发布一支广告,虚构开国元勋使用 Google Workspace 协作起草文件:本·富兰克林发短信催促杰斐逊,全程使用 Google Docs 协同编辑、Calendar 安排会议、Meet 远程参会(全员关摄像头),最终电子签名定稿。AI 元素包括:用"help me visualize"尝试不同国玺动物、Gemini...
OpenAI将ChatGPT引入Codex实现互嵌
据引用推文,OpenAI正将ChatGPT引入Codex,使Codex能嵌入ChatGPT,同时ChatGPT也能嵌入Codex。主推文则评论道:"说得更大声就更有道理了。" 🔗 阅读原文:https://x.com/jxnlco/status/2073509904594382908
给Codex发截图使用图像生成
最简单的方法是给Codex发送截图,然后告诉它使用图像生成。 🔗 阅读原文:https://x.com/jxnlco/status/2073503741505061233
耶鲁与芝加哥大学研究:LLM与人类研究想法的真实差距在范围而非质量
耶鲁大学与芝加哥大学通过11,683篇真实论文构建受控测试:为LLM提供每篇论文的邻近前期工作作为起点,要求其提出新的动机和方法,再与人类真实想法比较。关键发现:差距不在想法质量,而在想法范围--人类想法广泛分布于解释机制、测试失败、测量证据等多种模式;仅12.1%的人类想法主要是连接不同工作,而LLM中这一比例高达47.1%-64.2%(约为人类的4-5倍)。额外推理反而强化了该模式,表明...