RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
Perplexity CEO:微软塑造现代办公室工作模式
Perplexity AI 首席执行官 Aravind Srinivas 基本上在说,现代案头工作部分是由软件商业模式塑造的。他说微软基本上训练了现代办公室职员:坐在桌前,使用电脑,打开 Word,打开 Excel,发送文件,重复。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2073608230492881022
可灵AI NEXTGEN颁奖典礼预告
可灵 AI NEXTGEN 颁奖典礼 | 预告 敬请期待! 日期:2026 年 7 月 7 日 | 14:00-18:00 地点:首尔电影中心 🔗 阅读原文:https://x.com/Kling_ai/status/2073606317248311588
品味是一种冒险,是你选择偏离那条稳妥的平均线。
AI让创造变得轻易,但多数人能力过剩而品味不足。品味不仅是审美判断,更是预测他人喜好的能力。AI产生海量内容,容易回归平均值;真正的品味需要偏离安全线、敢于冒险。引用茶道故事:小堀远州选众人认可的美,利休有勇气爱只有自己能看到的。AI直接给出结果,剥夺了深度观察与练习的过程(如音乐转录给谱子而非训练耳朵)。当瓶颈从"创作"转向"观察",学徒制必须围绕注意力重建。 🔗...
结构化PDF到JSON:2026年开源提取模型指南
开源文档提取分为schema驱动的字段提取和文档结构解析两类。Datalab lift(9B视觉模型,基于Qwen 3.5)在225文档基准上达90.2%字段准确率、9.5秒中位延迟,代码Apache-2.0,权重使用修改版OpenRAIL-M。NuMind推出NuExtract 3(4B视觉语言模型),支持结构化提取和内容提取,通过vLLM提供OpenAI兼容API。IBM...
前OpenAI研究员谈AI时代核心能力转变
前OpenAI研究员Phil Chen指出,能被loss function评分的问题AI将全面超越人类,因此"解决问题"能力的溢价快速贬值,核心应转向"发现问题"--快速理解环境、识别重要问题的眼光比写代码更稀缺。同时,AI能轻松产出80分的中位数结果,但最后10%的打磨(细节优化、独特视角)才是90%回报的来源。建议放弃只追求"把事做对"的执行惯性,多练"选对事"和"做透"的非评分能力。...
更好的模型:更差的工具
Claude Opus 4.8 和 Sonnet 5 在调用 Pi 编辑工具时,会在 edits 数组中添加额外虚构字段(如 requireUnique、oldText2 等),导致工具调用因 schema 不匹配被拒绝,而旧版 Claude 模型无此问题。在持续会话中 Opus 4.8 的失败率约 20%,移除 thinking blocks 可将失败率减半,启用 strict tool...
Qwen前技术负责人Lin:混合思考模式冲突,转向智能体思考
Qwen前技术负责人Junyang Lin在演讲和独立研究文章中回顾Qwen系列,指出混合思考模式(thinking mode与instruct mode)在训练中互相冲突,导致模型行为退化。Qwen3采用四阶段后训练(长CoT冷启动、推理RL、思考模式融合)尝试融合,但后续2507版仍分离了Instruct和Thinking变体。Lin认为下一时代是智能体思考(agentic...
LG Display 用 AI 降本,每年可省超 2000 亿韩元
LG Display 通过推广基于 AI 的生产制造与产品研发系统,每年节省超 2000 亿韩元(约 8.81 亿元人民币)。公司正将虚拟设计验证技术(VDE)全面应用于下一代显示技术研发,无需制作实体样品即可优化方案、排查缺陷,缩短研发周期并省下数十亿韩元试产成本。自去年起,所有 OLED 产线已部署自研 AI...
日本工业机器人企业押注AI与开放式合作,欲重夺全球市场主导地位
安川电机北九州母工厂6月投产,约百台机器人中三分之一由AI驱动,生产效率翻倍,AI机型兼容12种产品。安川与英伟达合作推出Motoman...
贝佐斯:AI不会取代人类,而是提升生产力
Jeff Bezos 在 CNBC 表示,许多人担心 AI 会取代放射科医生、软件工程师等岗位,但这种看法是错误的。他认为 AI 实际会提升所有人的能力,就像给挖地基的人一把推土机--生产力将大幅提高,劳动力反而可能出现短缺。AI 不是取代工具,而是赋能工具。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2073578475395719310
sqlite-utils 4.0rc2 发布,大部分由 Claude Fable 编写
sqlite-utils 4.0rc2 发布,大部分代码由 Claude Fable 编写,成本约 $149.25。作者通过 Claude Code 对 4.0rc1 进行最终审查,发现 delete_where() 未提交导致数据丢失的严重 bug。经 37 次提示、34 次提交、30 个文件修改,修复问题并重构事务模型:每个写操作自动提交,新增 db.atomic()...
Palantir CEO 驳斥 AI 复制论:不懂企业核心痛点
在 CNBC 采访中,Palantir CEO Alex Karp 回应华尔街对 AI 可能复制 Palantir 业务的担忧。Karp 指出,AI 公司虽拥有优秀工程师,但缺乏对复杂、高风险企业实际问题的深刻理解。他举例称,无论是制造汽车零件、发射火箭还是执行军事任务,AI 公司的方案都无法落地。Karp 强调,高端企业绝不会采用这些不切实际的技术,何况还存在文化层面的根本隔阂。 🔗...
《Fable》开创了全新的4D飞溅效果格式
splat4d 是一种动态3D高斯飞溅时间序列格式,将每帧.splat文件编码为单个可流式文件。它包含静态部分(基础场景)和按秒分组的GOP块(关键帧+增量帧),采用误差有界量化(位置±2mm、颜色±4/255、旋转精确、缩放±2%),确保逐点确定性误差。设计针对HTTP...
英伟达免费提供GLM-5.2,注册即用
英伟达官方免费提供GLM-5.2模型,注册即可使用。引用推文补充:RPM约50,支持国内手机号验证,可一直loop。访问链接:build.nvidia.com/z-ai/glm-5.2。 🔗 阅读原文:https://x.com/berryxia/status/2073563859613544734
BestBlogs早报07-05:OpenAI Codex普及率、缓存命中率、Mistral形式化验证模型、Kimi入驻Copilot等10条AI资讯
BestBlogs早报汇总10条AI资讯:Greg Brockman指出OpenAI内部Codex普及率与Slack相当,模型上下文从2023年的2-4K tokens涨至52M;大模型缓存命中率可达90%,源于KV Cache+Prefix Caching及agent式只追加调用;Mistral AI发布6B参数开源形式化验证模型Leanstral 1.5,在miniF2F饱和、FATE...
AI工程重心转向系统集成:智能体临界点、缓存命中90%与类型化RAG合约
OpenAI总裁Greg Brockman指出智能体时代已到临界点,触发点是工程与信任成熟而非新模型,算力永远不够。阿里技术文章解释大模型缓存命中率90%是KV Cache+Prefix Caching+agent调用模式的必然结果。Towards Data Science提出RAG应使用类型化answer schema做合约,能确定性计算的字段(如金额比较)不应交给LLM,防止幻觉。 🔗...
消息称美国政府与Anthropic尚未商议政府入股该公司一事
路透社援引知情人士透露,特朗普政府与人工智能公司Anthropic从未商议政府入股。此前OpenAI已探讨向美国政府出让5%股份。美国政府正加强对大模型发布的监管审查,担忧滥用风险。今年6月,美国商务部撤销了针对Anthropic两款大模型的出口管制。特朗普正研究让普通民众持有头部AI企业股份的可行方案。参议员伯尼·桑德斯提出提案,要求大型AI企业向政府出让50%股权并允许政府派驻董事。...
AI HOT 日报 · 2026-07-05 — 我国研制全球首款基于可控存内计算的忆阻器神经动力学芯片
我国研制全球首款基于可控存内计算的忆阻器神经动力学芯片 — 点击查看完整日报
ResearchStudio-Reel:从论文到海报、视频和博客的自动化系统
ResearchStudio-Reel 由五个 Claude Code 和 Codex 技能组成,包含共享提取器 Paper2Assets,三个可编辑生成器 Paper2Poster、Paper2Video、Paper2Blog 以及交互式汇聚层 Paper2Reel。它一次性从论文中提取资产,生成打印级海报、同步讲解视频和双语博客,并支持在 PowerPoint 或 Word...
GPT-5.5 Codex 推理 token 聚类在 516/1034/1552 可能导致复杂任务性能下降
报告指出,Codex 的 GPT-5.5 模型推理输出 token 异常集中在 516、1034、1552 三个固定值。在 390,195 条记录中,GPT-5.5 响应精确命中 516 token 的比例为 44.0%,远高于其他模型(0.34%-19.8%)。2026 年 2 月至 6 月,精确 516 占比从 0.11% 升至 53.30%,同时平均推理 token 从 268.1...
AI数据中心耗水量远超企业披露,发电间接用水成巨大隐形消耗
微软、谷歌、亚马逊等巨头今明两年预计投入1万亿美元建设AI基础设施。美实验室报告显示,数据中心间接耗水量(发电环节)约为直接耗水的12倍。谷歌2025年报告披露直接耗水109亿加仑,间接约3倍;Meta间接耗水190亿加仑,是直接的20倍以上。英伟达展示闭环冷却系统无需补水;微软计划2027年起新建数据中心采用该技术。凤凰城当前数据中心用水占城市3%,到2031年或突破20%。多数新建数据中...
与AI Sol的幽默敬礼互动
用户向AI Sol发送大量🫡表情,Sol识别出共39个。用户要求乘以12再减800,Sol算出结果为-332,并解释负数意味着欠332个敬礼。用户再次发送39个🫡,Sol记录为支付,剩余债务293个。Sol以"敬礼经济是无情的"回应,展现其数学计算与幽默对话能力。 🔗 阅读原文:https://x.com/thsottiaux/status/2073554978053005607
MiniMax纳入codex.bar,可查reset过期时间
codex.bar 下一个版本将显示你的 reset 何时过期,方便你优化价值最大化。MiniMax 表示很高兴被收录,开源模型生态越来越好。 🔗 阅读原文:https://x.com/MiniMax_AI/status/2073554729842668027
BestBlogs 周刊:模型、Agent 与人的成本
洪明在推文中指出,当生成代码和原型实现的成本趋近于零,研发流程中最昂贵的部分已转移至系统验证、方案策展与判断力。本期 BestBlogs 周刊聚焦「模型、Agent 与人的成本」主题,沿着 4 条主线分析智能的账单,涵盖系统显性开销、Skill 隐性负债以及人机协作时的责任机制等,推荐阅读。 🔗...
智能的账单:模型、Agent与人的成本
本期周刊探讨模型、Agent与人的成本。关键数字:Claude Sonnet 5首发价输入2美元/百万token,输出10美元;GPT-5.6 Sol刷新Terminal-Bench 2.1成绩,输入5美元/百万token,输出30美元;LongCat-2.0总参数1.6T,平均激活48B,支持1M上下文;DeepSeek DSpark单用户速度提升60%-85%;Nano Banana...
Codex仍有让人惊讶的不足
你能说说,Codex 仍然做不好、而我们应该早就解决的事情是什么? 🔗 阅读原文:https://x.com/thsottiaux/status/2073551549494596079
英国"星际之门"项目被曝为"空头支票",OpenAI 从未实地考察核心选址
英国星际之门数据中心工程已于今年4月搁置,OpenAI称原因为监管政策与高昂能源成本。《卫报》披露,OpenAI从未实地考察核心选址钴园产业园,双方也未与当地政府会面。英国政府宣传的300亿英镑"潜在总投资"中,200亿英镑仅为建设所需成本,并非实际承诺投资。项目在特朗普访英前夕仓促推进,企业称被强制参与。选址未接入国家电网,现有基础设施无法支撑项目规模。 🔗...
CMU发布Gym-Anything:双智能体循环将任意软件转化为AI训练环境
CMU新研究提出Gym-Anything方法,通过双智能体循环自动将任意软件构造成AI智能体训练环境:一个智能体负责编写脚本、安装软件、加载真实数据并收集运行证据,另一个智能体用截图、日志、文件及清单审核证据并回传修复。基于该方法构建的CUA-World包含10,000+任务,覆盖200个应用和22个主要职业类别。测试显示,当前最强模型在困难长任务上也仅能解决一小部分,表明真实软件使用场景的...
AI成本失控:比人力更贵,Uber微软遇困境
Rohan Paul 认为AI正处混乱中间阶段:使用看似高效但产出不明确。Forbes报道称AI成本已超过其旨在取代的人力成本。Uber据报在4个月内烧光了2026年AI编码预算;微软因成本难以为继也削减了AI编码助手。Paul判断这只是过渡期尴尬阶段,预计未来10-18个月成本下降后将缓解。 🔗...