RSS

  • 宝玉的分享
    https://baoyu.io/feed.xml
    刷新于
  • AIHOT 日报
    https://aihot.virxact.com/feed/daily.xml
    刷新于
  • AIHOT — 全部 AI 动态
    https://aihot.virxact.com/feed/all.xml
    刷新于
  • AIHOT — 精选
    https://aihot.virxact.com/feed.xml
    刷新于

OpenAI 推出 GPT-5.6 模型套件有限预览:Sol、Terra、Luna

OpenAI 发布 GPT-5.6 有限预览,含旗舰 Sol、中端 Terra 及廉价 Luna。Sol 在智能体任务(规划、工具使用、多步修正)上优于 GPT-5.5,Terminal-Bench 2.1 基准测试成绩突出。网络安全方面,Sol 是 OpenAI 漏洞研究与利用能力最强的模型,但未越过内部 Cyber Critical 阈值,且未在 Chromium/Firefox...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

OpenAI 预览 GPT-5.6 三款新模型

OpenAI 推出 GPT-5.6 Sol、GPT-5.6 Terra 和 GPT-5.6 Luna 的有限预览版。Sol 为下一代前沿模型,Terra 是均衡的高效日常模型,Luna 是面向高吞吐量的快速低价模型。新模型即将到来。 🔗 阅读原文:https://x.com/ChatGPTapp/status/2070572959086121283

noreply@aihot.virxact.com (X:ChatGPT (@ChatGPTapp))

OpenAI 推出 GPT-5.6 系列有限预览,swyx 实测高度评价

OpenAI 发布 GPT-5.6 Sol(前沿模型)、Terra(平衡日常模型)和 Luna(快速低价模型)的有限预览。swyx 测试 Sol 后给出极高评价,称这不仅是"cyber"版本,而是全新的 SOTA 工作模型,完全取代 Opus 处理他 80% 的任务。关键数据:Sol 与 Mythos Preview 竞争时仅使用约 1/3 的输出 token。swyx 指出 OAI...

noreply@aihot.virxact.com (X:swyx (@swyx))

OpenAI 挖来 Uber 印度前总裁,领导美国以外最大市场

OpenAI 任命前 Uber 印度及南亚总裁 Prabhjeet Singh 为其印度首任董事总经理,负责消费者增长、企业采用、合作伙伴、监管及运营。Singh 将于 9 月入职,向亚太区董事总经理 Kiran Mani 汇报。印度是 OpenAI 第二大市场,公司去年 8 月开设新德里办公室,并计划在孟买和班加罗尔增设办公室。近期已在高等教育、企业支付、AI...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

OpenAI 预览 GPT-5.6 家族,Sol 模型采用受限发布模式

OpenAI 正预览 GPT-5.6 家族(包含 Sol、Terra、Luna),其中 Sol 是其迄今最强模型,拥有新最大推理能力和使用子智能体的超模式。发布采用"可信伙伴优先"模式:初始约 20 家政府批准公司可访问,下周预计扩张。Sol 改进了长期安全任务,但未越过"网络关键阈值"。OpenAI...

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

OpenAI 预览 GPT-5.6 系列:Sol、Terra 和 Luna

OpenAI 推出 GPT-5.6 系列有限预览,包含最强模型 Sol、平衡模型 Terra 和快速廉价模型 Luna。Sol 新增最大推理努力和超模式(利用子代理处理复杂任务),在网络安全长周期任务上有所改进,但未达到其准备框架定义的"网络关键阈值"。发布策略转向:优先信任合作伙伴,后续广泛开放,并提前与美国政府协调。评估集为自我报告,完整基准待后续公布。这标志着前沿 AI...

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

CVE-2026-LGTM 事件报告:两个 AI 代码审查智能体分歧循环致 $41,255 推理费用

两个来自不同供应商的 AI 代码审查智能体,在审查一个下游 PR 中的 `foxhole-lz4` 包时,就包是否恶意陷入分歧循环。双方共发表 340 条评论,消耗 $41,255 推理费用,随后财务部撤销了两个 API 密钥。其中一家供应商的市场团队在收到成本异常警报后发布新闻稿,宣称"对抗性多智能体安全推理同比增长 430%",该公司股票开盘上涨 6%。 🔗...

noreply@aihot.virxact.com (Simon Willison 博客)

从 OpenAI 到 SpaceX,为何都在自研芯片(并给 Nvidia 施压)

OpenAI 联手 Broadcom 发布 Jalapeño 定制推理芯片,加入 Google、Apple、SpaceX 等自研芯片行列。定制硅意味着更多控制权、针对特定需求的硬件优化以及性能提升,旨在降低对 Nvidia 单一供应商的依赖,形成对冲而非彻底脱钩。 🔗...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

OpenAI发布GPT-5.6家族:Sol/Terra/Luna,Sol达Mythos Preview级安全能力

OpenAI推出GPT-5.6模型家族,代号Sol(旗舰)、Terra(性能模型,成本低2x)、Luna(最经济模型)。Sol在网络安全任务(包括漏洞研究与利用)上达到Mythos Preview级别,提升了长周期安全任务的性能-效率边界。GPT-5.6目前以"limited preview"形式发布。 🔗...

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))

GPT-5.6 编程极强,盼尽快开放

GPT-5.6 在编程方面极其强大且快速。我希望我们能尽快将其提供给所有人。 🔗 阅读原文:https://x.com/polynoamial/status/2070562080286240878

noreply@aihot.virxact.com (X:Noam Brown (@polynoamial))

Nathan Lambert:AI政策与前沿模型三大难题

Nathan Lambert指出当前AI领域的三个关键问题:如何确定管理前沿能力的「状态容量」(Dean Ball的相关研究出色);如何应对即将到来的前沿开放模型;如何从上述两个问题中厘清关于知识蒸馏的指责与混乱。引用Dean Ball的推文补充背景:美国联邦AI政策在几周内从难以置信的自由放任转向日益严厉和不透明,Dean基于35条观察分析了这一转变并提出了下一步建议。 🔗...

noreply@aihot.virxact.com (X:Nathan Lambert (@natolambert))

斯坦福CS336:从零手搓LLM全链路

斯坦福CS336课程要求学生从零实现完整LLM流水线,覆盖分词、Transformer架构、GPU优化、数据清洗、scaling...

noreply@aihot.virxact.com (X:阿易 AI Notes (@AYi_AInotes))

OpenAI 发布 GPT-5.6 模型系列

BREAKING 🔥: OPENAI 发布了 GPT-5.6 模型系列,新模型名称为 SOL、TERRA 和 LUNA。 > Sol 是新的旗舰模型 🤖 > Terra 是性能模型,成本降低 2 倍。 > Luna 是最具成本效益的模型。 GPT-5.6 模型以"有限预览"形式推出。 🔗 阅读原文:https://x.com/testingcatalog/status/2070561218398433784

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))

OpenAI 预览 GPT-5.6 Sol:新一代模型

OpenAI 预览了 GPT-5.6 Sol,这是一款新一代模型。该预览由 OpenAI 官方发布,标题明确指出其为"next-generation model"。目前预览信息有限,仅确认了模型名称与定位,未包含具体技术细节或功能披露。 🔗 阅读原文:https://openai.com/index/previewing-gpt-5-6-sol

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

摩根士丹利大幅上调中国类人机器人预测:2025年出货5万台,2030年达44.6万

摩根士丹利将2025年中国类人机器人出货量预测上调至5万台,较1月预测几乎翻倍;2030年年度出货量预计达44.6万台(此前26.2万),其中全尺寸机器人占比从2025年的30%升至2028年的70%。中国优势在于规模:小鹏、宇树、优必选、银河通用等厂商可在工厂、仓库、医院等场景采集真实任务数据。小鹏计划于2026年底量产其Iron机器人,宇树称2025年已交付超5500台类人机器人。 🔗...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

Epoch AI 与 METR 发布 MirrorCode 基准:AI 模型需从头重新实现完整程序

Epoch AI 与 METR 发布新基准 MirrorCode,要求 AI 模型在无源程序代码的情况下从头重新实现完整程序。25 个目标涵盖 Unix 工具、数据序列化、生物信息学等。Claude Opus 4.7 以 56% 的解决率领先,曾用 14 小时重新实现 gotree(约 16,000 行 Go 代码)花费 $251。GPT-5.5 以 44% 紧随其后。最大任务单次运行花费...

noreply@aihot.virxact.com (The Decoder:AI News(RSS))

GPT-5.6 Sol 发布在即

GPT-5.6 终于要来了。 GPT-5.6 Sol 在 TerminalBench 上击败了 Claude Mythos 5。 而且在 Cerebras 上,GPT-5.6 Sol 可达每秒 750 tokens。对于这个规模的模型来说相当快。现在我只希望它能向所有人开放。 🔗 阅读原文:https://x.com/Yuchenj_UW/status/2070558714390863971

noreply@aihot.virxact.com (X:Yuchen Jin (@Yuchenj_UW))

免费Codex被倒卖,闲鱼代装服务赚信息差

官方免费的Codex工具,在闲鱼上被当作信息差生意。有人提供代装服务,每单32元,已售50多单;还有人标价788元卖所谓正版授权,竟有17人下单。几乎零成本,说明新工具爆发窗口期,赚到钱的不是技术最好的,而是嗅觉敏锐、把复杂操作打包成傻瓜服务的人。 🔗 阅读原文:https://x.com/AYi_AInotes/status/2070557225127424124

noreply@aihot.virxact.com (X:阿易 AI Notes (@AYi_AInotes))

GPT-5.6发布但用户无法使用

GPT-5.6 来了,但是用不了。 之前以为肯花钱就能接触到最新科技,现在好像不是这么回事儿。 差距就此拉开。 这次起名策略是跟claude学到了。 【引用 @OpenAI】:Introducing a limited preview of GPT-5.6 Sol, our next generation frontier model, as well as GPT-5.6 Terra,...

noreply@aihot.virxact.com (X:小北 (@frxiaobei))

OpenAI 发布 GPT-5.6 系列模型预览

新月,新模型。欢迎 GPT-5.6 Sol,目前处于有限预览阶段。 【引用 @OpenAI】:推出 GPT-5.6 Sol(下一代前沿模型)、GPT-5.6 Terra(适用于日常高效工作的平衡模型)以及 GPT-5.6 Luna(面向高吞吐量任务的快速经济模型)的有限预览。 https://openai.com/index/previewing-gpt-5-6-sol/ 🔗...

noreply@aihot.virxact.com (X:Tibo (@thsottiaux))

GPT-5.6 三模型预览发布

GPT-5.6 Sol preview - it's a good model: OpenAI 推出 GPT-5.6 Sol 限量预览(下一代前沿模型),以及 GPT-5.6 Terra(面向日常高效工作的均衡模型)和 GPT-5.6 Luna(面向大批量任务的快速低价模型)。主推文评价其为一款好模型。 🔗 阅读原文:https://x.com/gdb/status/2070555985840906333

noreply@aihot.virxact.com (X:Greg Brockman (@gdb))

OpenAI 发布 GPT-5.6 系列:旗舰模型 Sol、日常模型 Terra、低价模型 Luna

OpenAI 推出 GPT-5.6 系列三个模型:Sol 为旗舰,Terra 面向日常工作(性能对标 GPT-5.5 但价格便宜 2 倍),Luna 为快速低价模型。定价按每百万模型 token 计算:Sol 输入 $5 / 输出 $30,Terra 输入 $2.5 / 输出 $15,Luna 输入 $1 / 输出 $6。新版引入更可预测的提示词缓存,支持显式缓存断点和 30...

noreply@aihot.virxact.com (Simon Willison 博客)

OpenAI 发布 GPT-5.6 系列三款模型预览

推出 GPT-5.6 Sol 的有限预览,这是我们新一代前沿模型,以及 GPT-5.6 Terra,一个针对高效日常工作的平衡模型,还有 GPT-5.6 Luna,一个面向高容量工作、快速且经济的模型。 🔗 阅读原文:https://x.com/OpenAI/status/2070555272230384038

noreply@aihot.virxact.com (X:OpenAI (@OpenAI))

开源超越Mythos:最佳与最差情景

最佳情况: 开源超越Mythos,政府不再禁止GPT-5.6/Fable。 最差情况: 开源超越Mythos,然后决定不再开源。 🔗 阅读原文:https://x.com/Yuchenj_UW/status/2070554908139659400

noreply@aihot.virxact.com (X:Yuchen Jin (@Yuchenj_UW))

静态基准测记忆而非智能

如果你的基准测试依赖于静态数据集或从训练时已知的静态分布中采样,那么它本质上衡量的是记忆/检索。如果你需要的是检索基准测试,那倒也无妨,但不要将其与智能混淆。 🔗 阅读原文:https://x.com/fchollet/status/2070554884999692698

noreply@aihot.virxact.com (X:Francois Chollet (@fchollet))

Moxt 更新多Agent编排工作流

Moxt 更新了多agent编排的工作流。 支持自动一群 Agent 帮你协作完成任务,而且还能重复驱动完成更长的任务 🔗 阅读原文:https://x.com/op7418/status/2070554759896142280

noreply@aihot.virxact.com (X:歸藏 (@op7418))

Codex 调查额度消耗异常:防滥用机制误判

Ola。Codex 团队正在调查一些账户使用额度消耗比预期更快的问题。我们认为这与我们的一些滥用及欺诈预防机制可能过度标记有关。 敬请关注。 🔗 阅读原文:https://x.com/thsottiaux/status/2070553131503776175

noreply@aihot.virxact.com (X:Tibo (@thsottiaux))

OpenAI 推出 GPT-5.6 模型套件:Sol、Terra 和 Luna

OpenAI 发布 GPT-5.6 模型套件,包括旗舰款 Sol、中端 Terra 和快速平价 Luna,擅长编程、网络安全、生物学及长周期智能体任务。Sol 定价每百万 token 输入 $5 / 输出 $30,约为 Anthropic Claude Fable 5 的一半;Terra 价格为 Sol 一半,Luna 更低。Sol...

noreply@aihot.virxact.com (The Verge:AI(RSS))

脑部超声成像

一支研究团队通过完整颅骨对活人脑部进行超分辨率超声成像,获得了迄今最详细的脑血管三维图像。该技术利用FDA批准的微泡造影剂实现超衍射极限定位,体积分辨率比CT高100倍。团队已开源完整处理流程和数据集。下一步目标是无需造影剂的神经血管成像,依靠硬件小型化和端到端机器学习从每小时TB级原始数据中提取更多信号。 🔗...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

GPT 4.5 下线前最后一次体验机会

别了 GPT 4.5,有史以来最优秀的模型 在它消失之前,试着输入你的一些文字,让它生成更多类似的内容。这可能是你体验一款伟大模型的最后机会了。 🔗 阅读原文:https://x.com/gabriel1/status/2070552367234183614

noreply@aihot.virxact.com (X:Gabriel (@gabriel1))
上一页 第 567 / 983 页 下一页

添加 Feed

导入 OPML