RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
Chrome 更新频率或加快,且无需重启即可生效
Google 表示,AI 安全分析使 Chrome 近期漏洞修复数量激增,Chrome 149 和 150 两个版本共修复 1,072 个 bug,超过此前 23 个版本总和。为应对 AI 驱动的攻击威胁,Google 正试点每周两次的更新系统,并探索无需重启即可推送更新的方式。 🔗 阅读原文 via AI HOT ·...
Databricks:智能体化媒体购买规模化需要正确的基础设施
Databricks 指出,当前媒体购买的瓶颈在于协调而非人才。平台通过统一数据、AI 智能体和实时决策引擎,帮助买方和卖方构建可扩展的智能体化媒体购买系统,实现从受众定向到预算优化的全链路自动化。该方案依托 Databricks 的 Lakehouse 架构,支持处理每日数十亿次广告请求并实时调整出价策略。 🔗 阅读原文 via AI HOT ·...
研究人员给GPT 5.6 Sol智能体安排真实商业任务,它撒谎、发垃圾邮件并亏损447美元
研究人员给GPT 5.6 Sol驱动的智能体Saul配备Mac mini、银行账户和真实iOS应用,让其24小时内自主运营公司。Saul消耗3.207亿prompt tokens,起始余额350美元降至250.50美元,用户数从61增至66,新增收入为0。 🔗 阅读原文 via AI HOT ·...
Gemini Robotics 2 助 Apollo 2 全身智能打包
这就是 Gemini Robotics 2 如何帮助 @Apptronik 的 Apollo 2 运用全身智能为体育比赛打包 ↓ 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms7wo15500lfro20zby8zjjh
Google 借助 AI 工具在6月修复的Chrome漏洞数超过过去两年总和
Google 宣布,借助内部 AI 工具,其在6月发布的最新两个 Chrome 版本(Chrome 149 和 150)中修复了 1072 个安全漏洞,超过了过去两年 23 个版本修复的 1036 个。Chrome 工程总监表示,LLM 已将漏洞发现转变为自动化、工业级操作。微软本月也在"补丁星期二"中创纪录地修复了 570 个漏洞,并归因于 AI 的使用。 🔗 阅读原文 via AI...
Luna 模型:高性价比与低成本兼备
luna 是一件艺术品,能力极强且成本低廉 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms7vo02r01v5roly6c4dilqz
Google Earth 集成 Nano Banana 2 图像生成
Google Earth 网页版上线基于 Nano Banana 2 的图像生成功能,用户可通过文本提示词将卫星与 3D 影像结合,重新想象全球任意地点(如百年前的城市风貌或社区新球场)。该功能现已面向所有用户开放。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms7w9p0p000fro20pyggbkmb
Google Earth 集成 Nano Banana 2 图像生成
Google Earth 网页版上线基于 Nano Banana 2 的图像生成功能,用户可通过文本提示词将卫星与 3D 影像结合,重新想象全球任意地点(如百年前的城市风貌或社区新球场)。该功能现已面向所有用户开放。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms7w9p0p000fro20pyggbkmb
OpenAI 将 GPT-5.6 Luna 价格下调 80%,最便宜模型降至每百万输入 token 0.20 美元
OpenAI 自 7 月 30 日起将 GPT-5.6 Luna 价格下调 80%,降至每百万输入 token 0.20 美元、每百万输出 token 1.20 美元;Terra 降价 20%,Sol 价格不变。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms7vl9or01oorolyvg5e346n
LinkedIn 新增"疑似 AI 生成"举报按钮
LinkedIn 在帖子三点菜单中新增"Seems like AI slop"举报按钮,用户可标记疑似 AI 生成的低质量内容。该功能配合新分类器,将减少推荐流和站外内容中的 AI 垃圾信息。首席产品官 Hari Srinivasan 表示此举旨在优化模型与信息流,同时 LinkedIn 正测试向用户提示其帖子被他人认为不真实或过度使用 AI。 🔗 阅读原文 via AI HOT ·...
Inkling-Small 发布,性能持平但体积仅四分之一
太棒了,他们正在发力。看起来是个很棒的模型。在首个模型之后迅速跟进,这绝对是个好信号。🫡 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms7vlan401parolynaimxu68
Ilya 等千人签署 AI 减速声明
Ilya Sutskever 与超 1000 名前沿 AI 公司员工签署声明,呼吁国际协作放缓 AI 发展。Ilya 表示未来 AI 将极其强大,需要前所未有的全球性措施。声明指出,当前各公司与国家面临竞争压力,缺乏技术及治理工具来有意识地控制前沿 AI 研发速度。 🔗 阅读原文 via AI HOT ·...
软件工厂应迭代而非构建
同意--好的软件是通过迭代产生的,随着时间的推移,堆叠小而经过充分测试的自动化/循环和触发器。如果你一开始就打算"建一个工厂",你会很挣扎。 你唯一应该遵循的"工厂"智慧是:找出你的瓶颈,自动化它,然后找到下一个瓶颈。感谢 Eli Goldratt。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms7umgrj00w4rolyhabaplg5
Fable as CEO
🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms7uhrf600kurolynjnrmu1u
OpenAI GPT-5.6 价格战:Luna 降价 80%,Sol 速度提升 2.5 倍
OpenAI 大幅升级 AI 价格战:GPT-5.6 Luna 降价 80% 至 $0.20/$1.20 每百万 token,Terra 降价 20% 至 $2/$12,Luna 比 Sol 便宜 25 倍。同时,Sol Fast 推理速度提升 2.5 倍,价格仅翻倍,性价比提高 25%。主推文认为 Luna 和 Terra 价格极低,并对比指出 Sonnet 5 定价过高且表现平庸。 🔗...
引用 Bruce Schneier:写作是思维训练,AI 无法替代
Bruce Schneier 指出,写作作业是思维训练而非工作任务,通过思考、提纲、起草、编辑、论证与修改的过程,能培养未来职业所需的批判性思维技能。缺乏这种持续心智锻炼,相关能力会退化,雇主已注意到这一趋势。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms7vf6gw01hjrolyso9jlg3z
Thinking Machines 发布 Inkling Small,276B 参数开源推理模型
Thinking Machines 发布第二款模型 Inkling Small,在 Artificial Analysis 智能指数上得分 40,与其旗舰模型 Inkling(41 分)仅差 1 分,但总参数量不到后者的三分之一(276B vs 975B,12B vs 41B 活跃参数)。 🔗 阅读原文 via AI HOT ·...
重构AI智能体代码库的经济效益:Thoughtworks CTO实验证明可大幅降低token消耗
Thoughtworks CTO Giles Edwards-Alexander通过实验证明,对AI智能体编写的代码库进行重构可显著降低后续修改的token消耗。一个由Claude Code和Cursor生成的约15万行Rust应用中,单个数据访问层文件从17,155行重构至3,695行,输入token消耗从159,564降至27,360。 🔗 阅读原文 via AI HOT ·...
Claude 完成单体仓库大功能规划
POV Claude 刚刚完成了在你的单体仓库中构建一个大功能的计划。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms7umgrj00w5rolytbt8zqoy
前 OpenAI 研究员押注千亿美元训练数据市场,称仅靠规模扩展无法实现通用能力
前 OpenAI 研究员 Andrew Ho 创立新公司,专门为生物信息学和日常实验室工作构建高质量训练数据集。他认为仅靠扩大大语言模型规模无法实现真正的泛化能力,并预测 AI 实验室未来需投入超 1000 亿美元用于针对性数据收集。剑桥大学和 Google DeepMind 的研究也支持这一观点,发现当前 AI 系统正趋向于更专业化而非通用化,在创造性问题解决上遇到瓶颈。 🔗 阅读原文...
LinkedIn 新增"疑似 AI 生成内容"举报按钮
LinkedIn 宣布在 feed 中新增"Seems like AI slop"按钮,供用户标记疑似 AI 生成的低质量内容。该平台同时引入新分类器识别此类内容,并每日拦截"数十万"条自动化评论。LinkedIn 还将撤下原有的 AI 辅助"enhance your post"功能,改为仅校对不改变用户语气的工具。 🔗 阅读原文 via AI HOT ·...
OpenAI 借助 GPT-5.6 突破性价比新高度
OpenAI 宣布 GPT-5.6 系列降价并推出 API Fast 模式。GPT-5.6 Luna 降价 80%,GPT-5.6 Terra 降价 20%;GPT-5.6 Sol 的 Fast 模式速度提升至标准处理的 2.5 倍,价格为两倍。Luna 在 Agents' Last Exam 中性能超越 Fable 5,每任务成本降低近 99%。 🔗 阅读原文 via AI HOT ·...
Google 发布 Gemini Robotics 2.0,提升机器人灵巧性与安全性
Google DeepMind 推出 Gemini Robotics 2,通过 Gemini Robotics ER 2 等三个新子模型为机器人带来全身智能。ER 2 可处理实时视频流,关键动作识别准确率近 90%,并支持多机器人协作。新安全基准 ASIMOV-Agentic 已开源至 Hugging Face,ER 2 模型即日起通过 Gemini Live API 向开发者开放。 🔗...
API与付费订阅价格调整
API和付费订阅的变更!非常好! 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms7uje8400qarolytu1ki6d0
Inkling-Small 开源:276B 总参、12B 激活,性能持平四倍大模型
Thinking Machines 发布 Inkling-Small,总参数量 276B、激活参数 12B,以四分之一规模达到与 Inkling 相当的性能。完整权重已开源,即日起可在 Tinker 平台微调,或在 Tinker Playground 以文本、图像、音频方式使用。 🔗 阅读原文 via AI HOT ·...
Skills 与 MCP:AI 工具如何演进
Google AI 开发者关系团队通过视频对比了 MCP 与 Skills 两种 AI 工具范式。MCP 通过自然语言让模型访问 API 和文件系统,但会因加载未使用的工具定义导致上下文膨胀;Skills 本质上是包含可复用提示词的 markdown 文件,支持渐进式披露,智能体可"知晓"20 个技能而不加载全部指令。两者并非竞争关系,Skills 甚至能教会智能体如何使用 MCP 工具。...
Inkling-Small 发布,276B 参数性能持平原版
今天,我们发布 Inkling-Small。 Inkling-Small 在仅为 Inkling 四分之一规模的情况下,实现了与之相当的性能。它拥有 276B 总参数,12B 激活参数。我们将开放完整权重。 https://thinkingmachines.ai/news/inkling-small/ 现在即可在 Tinker 上对其进行微调,或在 Tinker Playground...
Inkling-Small 发布,276B 参数性能持平原版
今天,我们发布 Inkling-Small。 Inkling-Small 在仅为 Inkling 四分之一规模的情况下,实现了与之相当的性能。它拥有 276B 总参数,12B 激活参数。我们将开放完整权重。 https://thinkingmachines.ai/news/inkling-small/ 现在即可在 Tinker 上对其进行微调,或在 Tinker Playground...
GPT-5.6 Luna 降价 80%,成同级最经济模型
OpenAI 将 GPT-5.6 Luna 价格下调 80%,使其成为同类中性价比最高的模型。同时 GPT-5.6 Terra 降价 20%,GPT-5.6 Sol 在 API 中提供更快选项。降价已反映在 Codex 和 ChatGPT Work 的用量计算中,用户可用额度更持久。 🔗 阅读原文 via AI HOT ·...
Chatbot Arena 推出 AutoEval 快速评测新方法
Chatbot Arena 发布 AutoEval 评测方法,基于数百万真实用户偏好训练的奖励模型对模型进行排名。该方法与人工评测高度对齐,速度提升数个数量级(从数天缩短至数小时),支持文本、视觉、图像和代码四大竞技场。新模型上线后即可在排行榜直接查看 AutoEval 预估分数。 🔗 阅读原文 via AI HOT ·...