RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
GPT-5.6 三模型预览发布
GPT-5.6 Sol preview - it's a good model: OpenAI 推出 GPT-5.6 Sol 限量预览(下一代前沿模型),以及 GPT-5.6 Terra(面向日常高效工作的均衡模型)和 GPT-5.6 Luna(面向大批量任务的快速低价模型)。主推文评价其为一款好模型。 🔗 阅读原文:https://x.com/gdb/status/2070555985840906333
OpenAI 发布 GPT-5.6 系列:旗舰模型 Sol、日常模型 Terra、低价模型 Luna
OpenAI 推出 GPT-5.6 系列三个模型:Sol 为旗舰,Terra 面向日常工作(性能对标 GPT-5.5 但价格便宜 2 倍),Luna 为快速低价模型。定价按每百万模型 token 计算:Sol 输入 $5 / 输出 $30,Terra 输入 $2.5 / 输出 $15,Luna 输入 $1 / 输出 $6。新版引入更可预测的提示词缓存,支持显式缓存断点和 30...
OpenAI 发布 GPT-5.6 系列三款模型预览
推出 GPT-5.6 Sol 的有限预览,这是我们新一代前沿模型,以及 GPT-5.6 Terra,一个针对高效日常工作的平衡模型,还有 GPT-5.6 Luna,一个面向高容量工作、快速且经济的模型。 🔗 阅读原文:https://x.com/OpenAI/status/2070555272230384038
开源超越Mythos:最佳与最差情景
最佳情况: 开源超越Mythos,政府不再禁止GPT-5.6/Fable。 最差情况: 开源超越Mythos,然后决定不再开源。 🔗 阅读原文:https://x.com/Yuchenj_UW/status/2070554908139659400
静态基准测记忆而非智能
如果你的基准测试依赖于静态数据集或从训练时已知的静态分布中采样,那么它本质上衡量的是记忆/检索。如果你需要的是检索基准测试,那倒也无妨,但不要将其与智能混淆。 🔗 阅读原文:https://x.com/fchollet/status/2070554884999692698
Moxt 更新多Agent编排工作流
Moxt 更新了多agent编排的工作流。 支持自动一群 Agent 帮你协作完成任务,而且还能重复驱动完成更长的任务 🔗 阅读原文:https://x.com/op7418/status/2070554759896142280
Codex 调查额度消耗异常:防滥用机制误判
Ola。Codex 团队正在调查一些账户使用额度消耗比预期更快的问题。我们认为这与我们的一些滥用及欺诈预防机制可能过度标记有关。 敬请关注。 🔗 阅读原文:https://x.com/thsottiaux/status/2070553131503776175
OpenAI 推出 GPT-5.6 模型套件:Sol、Terra 和 Luna
OpenAI 发布 GPT-5.6 模型套件,包括旗舰款 Sol、中端 Terra 和快速平价 Luna,擅长编程、网络安全、生物学及长周期智能体任务。Sol 定价每百万 token 输入 $5 / 输出 $30,约为 Anthropic Claude Fable 5 的一半;Terra 价格为 Sol 一半,Luna 更低。Sol...
脑部超声成像
一支研究团队通过完整颅骨对活人脑部进行超分辨率超声成像,获得了迄今最详细的脑血管三维图像。该技术利用FDA批准的微泡造影剂实现超衍射极限定位,体积分辨率比CT高100倍。团队已开源完整处理流程和数据集。下一步目标是无需造影剂的神经血管成像,依靠硬件小型化和端到端机器学习从每小时TB级原始数据中提取更多信号。 🔗...
GPT 4.5 下线前最后一次体验机会
别了 GPT 4.5,有史以来最优秀的模型 在它消失之前,试着输入你的一些文字,让它生成更多类似的内容。这可能是你体验一款伟大模型的最后机会了。 🔗 阅读原文:https://x.com/gabriel1/status/2070552367234183614
华盛顿邮报报告:AI聊天机器人存在左翼偏见
《华盛顿邮报》报道,基于达特茅斯和斯坦福研究的测试显示,AI聊天机器人在约30项政策议题(税收、医保、移民等)上存在左翼偏见。GPT-5.5仅给出左倾立场占80%,双方立场17%,右倾3%;Gemini 3.1 Pro则93%给出双方立场,左倾仅7%;Claude Opus 4.8双方立场占57%;Grok...
华盛顿邮报报告:AI聊天机器人存在左翼偏见
《华盛顿邮报》报道,基于达特茅斯和斯坦福研究的测试显示,AI聊天机器人在约30项政策议题(税收、医保、移民等)上存在左翼偏见。GPT-5.5仅给出左倾立场占80%,双方立场17%,右倾3%;Gemini 3.1 Pro则93%给出双方立场,左倾仅7%;Claude Opus 4.8双方立场占57%;Grok...
Jason Liu 确认 Chief Vibe Officer 头衔
Jason Liu 确认了 thsottiaux 对自己的称呼--Chief Vibe Officer。 🔗 阅读原文:https://x.com/jxnlco/status/2070547710994940117
Weave 推出智能模型路由工具,可直接接入 Claude Code、Codex 和 Cursor
Weave 发布智能模型路由工具,通过 `npx @workweave/router` 安装,作为本地代理运行在 localhost:8080。它采用基于 Avengers-Pro 1 的集群评分器,每个请求自动选择最佳模型。支持 Anthropic、OpenAI、Gemini 原生 API,并通过 OpenRouter 接入...
人类对AI提升第一反应勉强应付
可能显而易见,但很多人对AI能力提升的第一反应将是"勉强应付"而非执行理性计划。(这就是人类在快速变化和复杂情况中一贯的做法,而且这里显然也在发生。) 🔗 阅读原文:https://x.com/emollick/status/2070545915341914397
文章中的新智元标题生成和Epub电子书生成Skill还是不错的,推荐试试。
文章中的新智元标题生成和Epub电子书生成Skill还是不错的,推荐试试。 【引用 @vista8】:http://x.com/i/article/2070045816782217216 🔗 阅读原文:https://x.com/vista8/status/2070545378123153546
郭明錤:iOS 27 将深度集成 Apple Intelligence
iOS 27 将带来与 Apple Intelligence 更紧密的系统级集成。我最新行业调查显示,苹果 2027 上半年搭载 A20 芯片的低端 iPhone 将升级至 9GB DRAM(1.5GB × 6 颗粒),高于当前 A19 机型的 8GB(2GB × 4 颗粒),以确保系统在 AI 负载下流畅运行。三款搭载 A20 Pro 芯片的 2026 下半年高端新机型(折叠屏及两款...
郭明錤:iPhone A20低阶款DRAM将升级至9GB
郭明錤最新产业调查指出,iOS 27将深化与Apple Intelligence的系统级整合。为确保AI负载下系统顺畅,1H27新款搭载A20处理器的较低阶iPhone DRAM规格升级至9GB(1.5GB × 6-die),高于当前A19机型的8GB(2GB × 4-die)。2H26配备A20 Pro的三款高阶机型(折叠机与两款18 Pro)则维持12GB(1.5GB ×...
AI 产品商业化:能力再强也怕找不到买单场景
AI 产品商业化最易卡在"能力很强,但不知道谁为哪个场景付钱"。仅有 skill/benchmark/多场景支持不能构成商业计划。客户真正需要的是:解决哪个具体工作、替代哪笔成本、谁有预算、如何验收、出问题谁担责。AI 产品最终卖的是可购买的确定性。 🔗 阅读原文:https://x.com/frxiaobei/status/2070544354704588805
宇树人形机器人室外演练中国武术
宇树机器人人形在户外表演了一段中国传统武术套路--流畅的踢腿、宽阔的站姿和精准的手臂动作,展现出强大的平衡与协调能力。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2070544113758601511
美国政府对AI模型发布加强管控,Anthropic与OpenAI面临相同困境
美国政府两周前撤下Anthropic的Fable和Mythos模型后,OpenAI的GPT...
Seedance 2.5 4K写实视频惊艳业界
Seedance 2.5 生成的15秒雪豹视频达到4K画质,绒毛、雪粒、瞳孔等细节高度写实,写实度远超现有AI视频模型。对比OpenAI停掉Sora,该版本实现了跨代领先,将行业基准线提升至多数团队难以企及的高度。 🔗 阅读原文:https://x.com/AYi_AInotes/status/2070543156169302241
西雅图明日小型AI见面会邀请
明天下午在组织一场小型AI见面会(西雅图Fremont/Ballard区域)。有兴趣请回复或私信。 🔗 阅读原文:https://x.com/natolambert/status/2070541873119428953
扩散模型发现巨无霸并优化汉堡
终于,AI找到了其终极无争议用途。 一个基于汉堡食谱训练的扩散模型"在没有显式监督的情况下发现了经典巨无霸,并生成了针对美味、可持续性或营养优化的新型汉堡。" ASI= automated slider intelligence 🔗 阅读原文:https://x.com/emollick/status/2070541631653023799
Gemini Drops 本月新功能一览
从用语音实时创建图像,到支持小企业的新方式,以下是本月 Gemini Drops 的内容 🧵 🔗 阅读原文:https://x.com/GeminiApp/status/2070539768618942859
Replit 450+集成,现更易查找
450+集成,现更易查找 https://x.com/i/broadcasts/1yxBeeQApqyJN 🔗 阅读原文:https://x.com/Replit/status/2070539061195096150
SuperNori 打造主动式家庭 AI 代理
在许多家庭中,让人疲惫的往往不是某件大事。 而是每天有人要记在心里的所有小事:几点出门避开拥堵、家里什么东西快用完了、客厅需不需要打扫、孩子吃得好不好、纪念日是否和别的安排冲突了。 SuperNori 正在构建一款主动式家庭 AI 代理,在这些小事变成需要有人记挂的负担之前,就注意到它们。 🔗 阅读原文:https://x.com/shao__meng/status/2070539037769904292
Chamath 选 SpaceX 弃 OpenAI 与 Anthropic
Chamath Palihapitiya 在 Axios Show 上被问到要在 OpenAI、Anthropic 或 SpaceX 的免费股份中保留哪一个。 他选择了 SpaceX。 他说世界通信基础设施早就需要一次重大升级,Starlink 定位于抓住这一转变的巨大份额,而今天听起来像科幻的事--在地球之外建立同样的业务--给了 SpaceX 巨大的长期选择空间。 🔗...
OpenAI Codex 2026年上半年活跃用户增长超5倍,非开发者增速最快
OpenAI 报告显示,Codex 在2026年上半年活跃用户增长超5倍,增速最快群体来自非开发者。截至2026年5月,80.6%的个体用户曾请求超30分钟的任务,70.2%超1小时,25.6%超8小时。自2025年8月以来,非开发者个体用户使用量增长约137倍,组织用户增长189倍。Codex 现已贡献 OpenAI 内部 99.8% 的周输出...