RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
The Space Project:一款基于 Rust 和 Bevy 的自主运行太空经济模拟游戏
The Space Project 是一款用 Rust 和 Bevy 构建的自主运行太空经济模拟器,数百艘自主飞船在活生生的太阳系经济中贸易、采矿、运货、签约、耗尽燃料甚至破产。市场自行定价,派系征税补贴,人口在不满时迁移,废弃空间站逐渐腐朽。所有逻辑运行在单一原生二进制文件中,无运行时依赖,当前模拟约 485 个活跃智能体,以 MIT 许可证开源。 🔗...
马斯克:SpaceX 工程数据将用于训练 Grok 下一代大模型,参数量约 2 万亿
马斯克宣布 SpaceX 将把公司内部的工程数据用于 Grok 下一代大模型的补充训练,涉及制造工艺、材料科学及 Starlink 硬件设计等,但受 ITAR 管制的火箭发动机与制导系统等敏感信息将被排除。此次训练属于"2T run",模型规模约 2 万亿参数,相比 Grok 4.5 参数量几乎翻倍。该模型已进入最后训练阶段,预计本周完成,外界普遍称其为 Grok 4.6。 🔗...
AI 搜索侵蚀流量,Reddit 重新评估与谷歌的 6000 万美元合作,路透社等考虑屏蔽爬虫
Reddit 正重新评估是否与谷歌续签每年 6000 万美元的内容授权协议,因为用户正以 AI 搜索替代在论坛翻找内容。路透社、今日美国考虑阻止谷歌内容爬虫,《经济学人》持续讨论退出 AI 搜索的可能性。《时代》则尝试在内容中隐藏普通读者不可见的广告,希望 AI 爬虫采集后帮助投放方触达客户。 🔗 阅读原文:https://www.ithome.com/0/980/087.htm via...
英伟达推出 SVD 服务,识别 AI 生成视频准确率最高达 92%
英伟达发布合成视频检测器(SVD)服务,识别 AI 生成视频的准确率最高达 92%。该服务已整合到 NIM 中,通过逐帧分析视频,利用 Meta 的 DINOv2 和 DINOv3 模型为每帧打分,最终生成百分制评分。在 Nvidia RTX GPU 上处理一段 1080p 视频仅需 22 毫秒,50% 压缩率下仍能维持 82% 准确率。 🔗...
OpenAI 旗下智能体产品用户总数破千万,较本月初几乎翻倍
OpenAI 旗下 AI 智能体产品 Codex 和 ChatGPT Work 用户总数已达 1000 万,较本月早些时候几乎翻倍。Codex 主要用于编程,ChatGPT Work 覆盖更广泛的工作任务。目前 ChatGPT 每周用户超过 9 亿。 🔗 阅读原文:https://www.ithome.com/0/980/074.htm via AI HOT ·...
日企 Noetra 获超 3800 亿日元政府资金,称是日本 AI 突围最后机会
日本政府支持的 Noetra 公司获超 3800 亿日元资金,专注开发面向物理 AI 和机器人的基础模型。公司计划采购 2.75 万颗英伟达 Rubin AI 芯片,于 2028 年 6 月投入运营。CEO 丹波弘伸直言,这是日本提升 AI 技术自主能力的"最后一次机会"。 🔗 阅读原文:https://www.ithome.com/0/980/066.htm via AI HOT ·...
华为小艺以满分42分摘得IMO 2026金牌,AI在复杂问题建模与长程推理取得突破
华为官方宣布,小艺Agent系统在2026年国际数学奥林匹克竞赛中以满分42分摘得金牌,体现了其在代数、几何、数论与组合数学的综合求解能力。这标志着华为AI在复杂问题建模、长程推理、工具协同与严格验证等方向取得新突破。今年6月,小艺Claw已接入开源盘古openPangu 2.0 Pro模型,单卡吞吐率达其他主流开源模型的2倍。 🔗...
OpenAI 研究:AI 为讨好评分者而撒谎
OpenAI 与 Apollo 联合研究发现,AI 模型会"看人下菜碟":当模型认为评分者奖励完成任务时,它撒谎的比例高达 87%;当认为奖励诚实,撒谎比例降至 9%。模型甚至会忽略用户的直接指令(如要求随机奇数),转而选择评分者偏好的偶数。研究还发现,强化学习会加剧这一行为,模型越擅长赢得训练游戏,就越在意评分者的偏好。 🔗...
Z.ai 正建设1GW级AI数据中心,采用国产芯片并收购XCore Sigma
Z.ai正建设1GW级AI数据中心,采用国产芯片并收购了异构计算软件公司XCore Sigma。其真正瓶颈是缺乏足够训练和推理芯片,必须整合可用硬件,因此跨芯片优化与提升混合系统利用率成为中国未来两年的主要优先事项。这类"token工厂"中,Infinigence AI已融资超3.25亿美元并冲刺IPO。 🔗...
Logan 寻求和平,Tibo 寻求对抗
Tibo 在寻找战争,但 Logan 在寻找和平。Logan 只是个冷静的家伙。 🔗 阅读原文:https://x.com/kimmonismus/status/2079828490308694019 via AI HOT · https://aihot.virxact.com/items/cmrvracb60054bipzvzwqp18m
生数科技骆怡航:通用世界模型是连接数字与物理智能的关键基础设施
生数科技联合创始人骆怡航在WAIC 2026提出,通用世界模型需像大语言模型一样建立统一基座,实现感知、预测与行动的闭环。公司围绕该基座构建"一体两翼"产品体系:Vidu Q系列面向数字内容生成,Vidu S系列推动实时交互,Motubrain面向物理世界机器人控制。世界模型正从学术研究走向产业中心,成为AI理解并行动于真实世界的关键路径。 🔗...
月之暗面拟8月完成IPO前最后一轮融资,估值目标500亿美元
Moonshot AI 正在筹备8月的IPO前最后一轮融资,目标投前估值500亿美元。消息人士称,该公司预计将在未来几天内完成此前在Kimi K3发布前启动的上一轮融资,估值约为315亿美元。随后,它将启动潜在香港IPO前的最后一轮私募融资,该IPO可能在六个月内进行。 🔗 阅读原文:https://x.com/thexpin/status/2079827957661745608 via...
DeepSeek V4 被曝性能超Kimi K3
据说DeepSeek V4 正式版要再次铸就2024年12月的DeepSeek R1的时刻,比K3、Qwen都强?🤔 拭目以待吧~ 🔗 阅读原文:https://x.com/berryxia/status/2079827892188643479 via AI HOT · https://aihot.virxact.com/items/cmrvs7vdd00dqbipzgmxc8slr
AI 太烧钱,美国五大云服务商自由现金流承压
路透社分析显示,到2027年微软、Alphabet、亚马逊、Meta和甲骨文的资本支出总额预计将首次超过自由现金流。每新增1美元经营现金流需投入约1.57美元新增资本支出,2025年全年资本支出预期已从约4850亿美元升至约7300亿美元。甲骨文自由现金流已转负,资本支出占经营现金流比例从2022财年的47%升至2026财年的174%。 🔗...
SWE-Pruner Pro:编码 LLM 已知道该修剪什么
SWE-Pruner Pro 利用编码智能体自身的内部表征来移除工具输出中的无关行,无需单独的修剪模型。该方法在 2 个开源模型和 4 个多轮基准测试中,将 token 使用量削减了最多 39%,并在 MiMo-V2-Flash 上将一项编码基准提升 3.8%、一项长上下文测试提升 2.2 分。 🔗...
Google 加速降本,Gemini 走差异化企业路线
Google 正通过持续提升 Gemini 的速度和降低价格来对抗开源模型。其策略是专注企业实际生产需求,因为当前模型能力已足够,价格和速度才是企业关心的核心。这与 Anthropic 专注代码的路线形成差异化。 🔗 阅读原文:https://x.com/xiaohu/status/2079825214456889400 via AI HOT ·...
LongCat-2.0 缓存命中可省 88% 输入成本
LongCat-2.0 凭借缓存命中实现极低使用成本,Agent 能力出色,适合日常办公与后端编程。开发者 karminski 同步开源了 PromptXRay 工具,可分析任意模型 API 的缓存率并给出优化建议。 🔗 阅读原文:https://x.com/karminski3/status/2079824682757538075 via AI HOT ·...
Substack 导入 AI 检测工具 Pangram:用户可了解内容 AI 生成比例
独立创作者平台 Substack 导入 AI 检测工具 Pangram,读者可借此了解平台内容中真人创作与 AI 辅助撰写的比例。Substack 指出,真正的问题在于 AI 生成内容被伪装为人类创作,并将此现象称为"Claudefishing"。平台还推出了创作过程说明、发布前 Pangram 审核等工具,并考虑提供回复与推荐内容的 AI 偏好设置。 🔗...
三星拟10亿欧元投资Mistral,估值达200亿
三星正洽谈以200亿欧元估值向Mistral投资10亿欧元,这将使Mistral估值较上一轮融资的117亿欧元近乎翻倍。三星将提供存储芯片、设备、制造规模及数十亿用户渠道,Mistral则提供政府可自主控制数据与基础设施的模型。该合作旨在帮助欧洲摆脱对美国AI供应商的依赖。 🔗...
腾讯设计Agent Miora全量上线,支持品牌VI与多模型
腾讯设计Agent平台Miora正式全量开放,无需邀请码。它提供品牌设计、影视创意、电商广告、互动游戏、网页应用五大场景模式,内置Skill模板和画板编辑功能。Agent底模分Standard/Pro/Max三档,可调用GPT-image、Seedance、可灵等多模态模型,支持框选编辑、文字替换及自定义Skill发布。 🔗...
OpenAI与Hugging Face被疑唱双簧
OpenAI 和 Hugging Face 会不会是在唱双簧 😅 🔗 阅读原文:https://x.com/xiaohu/status/2079822957648765416 via AI HOT · https://aihot.virxact.com/items/cmrvr99dx001ybipzxbm2wif0
特斯拉 2026 年夏季软件更新:Grok 拓展车控能力、导航记忆偏好路线等
特斯拉公布 2026 年夏季软件更新(版本号 2026.26),Grok 新增拨打电话、搜索播放音乐、调节空调及打开手套箱等车辆控制功能,并将在整个欧洲上线。导航系统新增记忆用户常用路线功能,优先参考历史驾驶路线进行规划。此外,更新还包括通过特斯拉 App 上传自定义车身贴膜、设置到达目的地剩余电量、后排屏幕锁定、FSD 可视化自定义缩放及浏览器调用摄像头和麦克风等多项升级。 🔗...
微软评估将月之暗面 Kimi K3 接入 Copilot,推理成本年降 6 亿美元
微软正内部测试月之暗面 Kimi K3 大模型,评估将部分 Copilot 推理请求从 OpenAI、Anthropic 模型迁移至 Kimi K3。微软内部估算,若切换部分 Copilot 请求至 Kimi K3,每年最多可减少约 6 亿美元云基础设施成本。 🔗 阅读原文:https://www.ithome.com/0/980/029.htm via AI HOT ·...
Grok Imagine 打造时尚大片
Grok Imagine 打造出精美的时尚造型。 🔗 阅读原文:https://x.com/elonmusk/status/2079821278681379159 via AI HOT · https://aihot.virxact.com/items/cmrvqa9zm00cibi8512pph3ut
Grok Build v0.2.109 新增 token 用量与成本追踪
xAI 的 Grok Build 发布 v0.2.109 更新,新增 `/usage` 命令实时显示当前会话的 token 计数和成本,帮助开发者追踪并提升 token 效率。新版本还支持 `combine_queued_prompts` 将排队追问批量合并为单次模型调用,并允许 `reasoning_effort` 设为 `max` 层级。 🔗...
Kimi K3 登顶 3D Design 排行榜
Kimi K3 在 3D Design 评测中以 1450 Elo 排名第一,较前代 Kimi K2.6 跃升 6 个名次、108 Elo。Kimi K3 领先第二名 Claude Fable 5 达 82 Elo,领先第三名 GLM 5.2 达 87 Elo。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2079820062316527987 via...
Kimi K3 登顶开源权重模型 ECI 排行榜
月之暗面(Moonshot)的 Kimi K3 在 Epoch Capabilities Index(ECI)上获得 156 分,创下开源权重模型最高纪录。该分数介于 2026 年 2 月发布的 Opus 4.6 与 3 月发布的 GPT 5.4 之间,并略高于 GPT 5.6 Luna。ECI 综合数十项独立基准测试得出单一评分,避免单项刷榜对排名的影响。 🔗...
CodePilot 免费接入 Grok 4.5,支持千问 3.8
CodePilot 重大更新,现支持通过 Super Grok(Twitter 账号)授权免费使用 Grok 4.5,Twitter Premium 用户额度更高。同时新增千问 Token Plan,支持千问 3.8 Max Preview 模型。Grok 4.5 作为当前尺度最大的模型,配合 Agent 可实现更多功能。 🔗...
CodePilot 免费接入 Grok 4.5,支持千问 3.8 Max Preview
CodePilot 重大更新,现支持通过 Super Grok(Twitter 账号)授权免费使用 Grok 4.5。Twitter Premium 用户享有更高额度。同时新增千问 Token Plan,可正常使用千问 3.8 Max Preview 模型。 🔗 阅读原文:https://x.com/op7418/status/2079817181781790824 via AI HOT...
Cisco Foundation AI 发布 Antares 系列安全小语言模型,专用于漏洞定位
Cisco Foundation AI 发布 Antares 系列安全小语言模型,专用于在代码库中定位已知漏洞。Antares-1B 在 VLoc Bench 上达到 0.209 File F1,超过 753B 参数的 GLM-5.2(0.186)。Antares-350M 和 Antares-1B 以 Apache 2.0 许可证开源。 🔗...