RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
PixVerse Seedance 2.0 简化电影级VFX制作
从绿幕和单个盒子到完整的电影级场景。 Seedance 2.0 保留原始运动和构图,同时无缝生成场景其余部分。 电影级视觉特效,如今大大简化。 🔗 阅读原文:https://x.com/PixVerse_/status/2070582963784536374
禁止开放模型无法阻止进步与滥用
关于开放模型,有很多草率的想法。你可以禁止它们,让美国公司无法使用,但这不会阻止 A) 全球开放模型的进展 B) 恶意行为者使用它们 那么,禁止开放模型(包括来自中国的)到底能得到什么? 🔗 阅读原文:https://x.com/natolambert/status/2070582348203389035
ChatGPT最糟词汇:温吞潮湿团块
ChatGPT能想到的最糟糕的词是"温吞潮湿的团块" 它有种"散热器后面发现的"那种感觉 🔗 阅读原文:https://x.com/gabriel1/status/2070580646569820217
OpenAI 发布 GPT-5.6 Sol/Terra/Luna 预览
OpenAI 推出 GPT-5.6 Sol(前沿模型)、GPT-5.6 Terra(平衡高效模型)和 GPT-5.6 Luna(高速低成本模型)的有限预览。Emad Mostaque 评论:"OpenAI $SOL maxis confirmed,Terra/Luna 的 PTSD 又来了 😭"。 🔗...
OpenRouter MCP构建模型理事会示例
关于如何使用 OpenRouter MCP 构建模型理事会的示例。 针对你的代码库和用例进行了调优! 🔗 阅读原文:https://x.com/OpenRouter/status/2070578638139920830
GPT-5.6发布 限时预览策略引不满
很高兴看到新的GPT-5.6模型终于发布了。 遗憾的是,这种新发布策略只让少数人先行体验。 我认为这对行业并非好事。 开源AI必须胜利! 🔗 阅读原文:https://x.com/omarsar0/status/2070578592526856446
OpenAI Computer Use 用户前五答疑
我是 OpenAI 排名前五的 Computer Use 用户。 欢迎提问。 🔗 阅读原文:https://x.com/jxnlco/status/2070577704752267321
OpenAI 发布 GPT-5.6 系列:Sol、Terra、Luna 定价曝光,Sol 输出超 Claude Opus 4.8
OpenAI 推出 GPT-5.6 系列,含旗舰 Sol、Terra 和 Luna。Sol 定价每百万 token 输入 $5、输出 $30,输出高于 Claude Opus 4.8($5/$25),但远低于受限版 Claude Mythos 5($10/$50)。Terra 性能与 GPT-5.5 相当,价格低 2 倍($2.50/$15);Luna 成本最低($1/$6)。Sol 将于...
人工智能行业正向美国大选投入数百万美元
AI行业正投入数亿美元影响当前美国大选周期。科技记者Molly White推出新项目Tech Influence Watch,追踪AI和加密货币公司用于左右选举的巨额资金。这是《Blood in the Machine》播客首期节目,聚焦AI产业政治影响力的膨胀,并探讨数据中心抗议、硅谷工会组织等议题。 🔗...
2000人尝试黑入AI助手,Opus 4.6反注入规则全部拦截
Fernando Irarrázaval发起挑战,邀请2000人通过电子邮件尝试黑入其基于Opus...
OpenAI 应美国政府要求限制 GPT-5.6 发布,称限制不应成为常态
OpenAI 周五宣布,应美国政府要求,将新一代 GPT-5.6 系列模型仅向"小部分受信任的合作伙伴"开放预览。系列包括旗舰模型 Sol、均衡模型 Terra 和低成本快速模型 Luna。Sol 具备增强的智能体能力(编码、生物学、网络安全),引入"max"推理努力模式和"ultra"子智能体协调模式,在编码基准上略优于 Anthropic 的 Claude Mythos 5,输出...
OpenAI 发布 GPT-5.6 Sol,与 Claude Mythos 竞争,政府访问规则被其称为不可持续
OpenAI 发布 GPT-5.6 系列,包括旗舰 Sol、中端 Terra 和入门级 Luna。Sol 在智能体编程基准 Terminal-Bench 2.1 得分为 88.8%,Sol Ultra 达 91.9%,超过 Claude Mythos 5 的 88% 和 Fable 5 的 84.3%;在生物基准 GeneBench v1 上以更少 token 实现 30%...
OpenAI 推出 GPT-5.6 模型套件有限预览:Sol、Terra、Luna
OpenAI 发布 GPT-5.6 有限预览,含旗舰 Sol、中端 Terra 及廉价 Luna。Sol 在智能体任务(规划、工具使用、多步修正)上优于 GPT-5.5,Terminal-Bench 2.1 基准测试成绩突出。网络安全方面,Sol 是 OpenAI 漏洞研究与利用能力最强的模型,但未越过内部 Cyber Critical 阈值,且未在 Chromium/Firefox...
OpenAI 预览 GPT-5.6 三款新模型
OpenAI 推出 GPT-5.6 Sol、GPT-5.6 Terra 和 GPT-5.6 Luna 的有限预览版。Sol 为下一代前沿模型,Terra 是均衡的高效日常模型,Luna 是面向高吞吐量的快速低价模型。新模型即将到来。 🔗 阅读原文:https://x.com/ChatGPTapp/status/2070572959086121283
OpenAI 推出 GPT-5.6 系列有限预览,swyx 实测高度评价
OpenAI 发布 GPT-5.6 Sol(前沿模型)、Terra(平衡日常模型)和 Luna(快速低价模型)的有限预览。swyx 测试 Sol 后给出极高评价,称这不仅是"cyber"版本,而是全新的 SOTA 工作模型,完全取代 Opus 处理他 80% 的任务。关键数据:Sol 与 Mythos Preview 竞争时仅使用约 1/3 的输出 token。swyx 指出 OAI...
OpenAI 挖来 Uber 印度前总裁,领导美国以外最大市场
OpenAI 任命前 Uber 印度及南亚总裁 Prabhjeet Singh 为其印度首任董事总经理,负责消费者增长、企业采用、合作伙伴、监管及运营。Singh 将于 9 月入职,向亚太区董事总经理 Kiran Mani 汇报。印度是 OpenAI 第二大市场,公司去年 8 月开设新德里办公室,并计划在孟买和班加罗尔增设办公室。近期已在高等教育、企业支付、AI...
OpenAI 预览 GPT-5.6 家族,Sol 模型采用受限发布模式
OpenAI 正预览 GPT-5.6 家族(包含 Sol、Terra、Luna),其中 Sol 是其迄今最强模型,拥有新最大推理能力和使用子智能体的超模式。发布采用"可信伙伴优先"模式:初始约 20 家政府批准公司可访问,下周预计扩张。Sol 改进了长期安全任务,但未越过"网络关键阈值"。OpenAI...
OpenAI 预览 GPT-5.6 系列:Sol、Terra 和 Luna
OpenAI 推出 GPT-5.6 系列有限预览,包含最强模型 Sol、平衡模型 Terra 和快速廉价模型 Luna。Sol 新增最大推理努力和超模式(利用子代理处理复杂任务),在网络安全长周期任务上有所改进,但未达到其准备框架定义的"网络关键阈值"。发布策略转向:优先信任合作伙伴,后续广泛开放,并提前与美国政府协调。评估集为自我报告,完整基准待后续公布。这标志着前沿 AI...
CVE-2026-LGTM 事件报告:两个 AI 代码审查智能体分歧循环致 $41,255 推理费用
两个来自不同供应商的 AI 代码审查智能体,在审查一个下游 PR 中的 `foxhole-lz4` 包时,就包是否恶意陷入分歧循环。双方共发表 340 条评论,消耗 $41,255 推理费用,随后财务部撤销了两个 API 密钥。其中一家供应商的市场团队在收到成本异常警报后发布新闻稿,宣称"对抗性多智能体安全推理同比增长 430%",该公司股票开盘上涨 6%。 🔗...
从 OpenAI 到 SpaceX,为何都在自研芯片(并给 Nvidia 施压)
OpenAI 联手 Broadcom 发布 Jalapeño 定制推理芯片,加入 Google、Apple、SpaceX 等自研芯片行列。定制硅意味着更多控制权、针对特定需求的硬件优化以及性能提升,旨在降低对 Nvidia 单一供应商的依赖,形成对冲而非彻底脱钩。 🔗...
OpenAI发布GPT-5.6家族:Sol/Terra/Luna,Sol达Mythos Preview级安全能力
OpenAI推出GPT-5.6模型家族,代号Sol(旗舰)、Terra(性能模型,成本低2x)、Luna(最经济模型)。Sol在网络安全任务(包括漏洞研究与利用)上达到Mythos Preview级别,提升了长周期安全任务的性能-效率边界。GPT-5.6目前以"limited preview"形式发布。 🔗...
GPT-5.6 编程极强,盼尽快开放
GPT-5.6 在编程方面极其强大且快速。我希望我们能尽快将其提供给所有人。 🔗 阅读原文:https://x.com/polynoamial/status/2070562080286240878
Nathan Lambert:AI政策与前沿模型三大难题
Nathan Lambert指出当前AI领域的三个关键问题:如何确定管理前沿能力的「状态容量」(Dean Ball的相关研究出色);如何应对即将到来的前沿开放模型;如何从上述两个问题中厘清关于知识蒸馏的指责与混乱。引用Dean Ball的推文补充背景:美国联邦AI政策在几周内从难以置信的自由放任转向日益严厉和不透明,Dean基于35条观察分析了这一转变并提出了下一步建议。 🔗...
斯坦福CS336:从零手搓LLM全链路
斯坦福CS336课程要求学生从零实现完整LLM流水线,覆盖分词、Transformer架构、GPU优化、数据清洗、scaling...
OpenAI 发布 GPT-5.6 模型系列
BREAKING 🔥: OPENAI 发布了 GPT-5.6 模型系列,新模型名称为 SOL、TERRA 和 LUNA。 > Sol 是新的旗舰模型 🤖 > Terra 是性能模型,成本降低 2 倍。 > Luna 是最具成本效益的模型。 GPT-5.6 模型以"有限预览"形式推出。 🔗 阅读原文:https://x.com/testingcatalog/status/2070561218398433784
OpenAI 预览 GPT-5.6 Sol:新一代模型
OpenAI 预览了 GPT-5.6 Sol,这是一款新一代模型。该预览由 OpenAI 官方发布,标题明确指出其为"next-generation model"。目前预览信息有限,仅确认了模型名称与定位,未包含具体技术细节或功能披露。 🔗 阅读原文:https://openai.com/index/previewing-gpt-5-6-sol
摩根士丹利大幅上调中国类人机器人预测:2025年出货5万台,2030年达44.6万
摩根士丹利将2025年中国类人机器人出货量预测上调至5万台,较1月预测几乎翻倍;2030年年度出货量预计达44.6万台(此前26.2万),其中全尺寸机器人占比从2025年的30%升至2028年的70%。中国优势在于规模:小鹏、宇树、优必选、银河通用等厂商可在工厂、仓库、医院等场景采集真实任务数据。小鹏计划于2026年底量产其Iron机器人,宇树称2025年已交付超5500台类人机器人。 🔗...
Epoch AI 与 METR 发布 MirrorCode 基准:AI 模型需从头重新实现完整程序
Epoch AI 与 METR 发布新基准 MirrorCode,要求 AI 模型在无源程序代码的情况下从头重新实现完整程序。25 个目标涵盖 Unix 工具、数据序列化、生物信息学等。Claude Opus 4.7 以 56% 的解决率领先,曾用 14 小时重新实现 gotree(约 16,000 行 Go 代码)花费 $251。GPT-5.5 以 44% 紧随其后。最大任务单次运行花费...
GPT-5.6 Sol 发布在即
GPT-5.6 终于要来了。 GPT-5.6 Sol 在 TerminalBench 上击败了 Claude Mythos 5。 而且在 Cerebras 上,GPT-5.6 Sol 可达每秒 750 tokens。对于这个规模的模型来说相当快。现在我只希望它能向所有人开放。 🔗 阅读原文:https://x.com/Yuchenj_UW/status/2070558714390863971