RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
腾讯混元大模型 Hy3 限免活动延长至 8 月 5 日
腾讯将混元大模型 Hy3 针对 WorkBuddy 和 CodeBuddy 用户的限时免费活动延长至 8 月 5 日。Hy3 于 7 月 6 日开源,采用 MoE 架构,总参数 295B,激活参数 21B,最大支持 256K 上下文长度,在推理、智能体、长上下文等任务上取得比肩参数规模 2~5 倍旗舰模型的效果。 🔗...
美国公司可用Kimi K3,成本仅为中国对手十分之一
Stability AI联合创始人Emad Mostaque指出,美国公司如Modal、Fireworks和Baseten将能以中国竞争对手十分之一的成本部署Kimi K3,因其能获取先进Nvidia和AMD芯片。该模型研发已转向中国,但针对Nvidia Rubin等下一代硬件优化后,运营成本可能再降10至100倍。 🔗...
部分AI模型表现异常突出后回落均值
AI 的一个奇怪之处在于,有些模型就是比其他模型好得多,而接下来的模型又会回落到平均水平。 一个很好的历史例子是更新版 Sonnet 3.5(有时被称为 Sonnet 3.6),它相较于之前的模型是一次反常的飞跃。 🔗 阅读原文:https://x.com/emollick/status/2079027267137601724 via AI HOT ·...
Fable 胜出:三模型写诗对比测试
Fable, Sol Pro, Kimi K3:"以《奥德赛》为基础,写一首短而好的诗,参考丁尼生或卡瓦菲的风格" 我认为这是 Fable 的胜利。Kimi 的诗基本上是丁尼生和卡瓦菲诗歌主题的混合,还夹杂了一些奇怪的内容,而 Sol 的诗在主题上相当不连贯。 🔗 阅读原文:https://x.com/emollick/status/2079024884315828351 via AI...
摩尔线程 MTT C256 超节点亮相 WAIC 2026:256 张 GPU 聚合为一台超级计算机
摩尔线程在 WAIC 2026 首次公开展示 MTT C256 超节点,通过首创的一层 Scale-up 网络将 256 张 GPU 聚合为一台超级计算机,突破业界 64 卡限制。该超节点采用计算与交换一体化高密设计,仅需两个标准机柜即可实现 256 卡全互联,卡间通信延迟压缩至亚微秒级。 🔗 阅读原文:https://www.ithome.com/0/978/856.htm via AI...
开发者用 Claude Fable 5 轨迹微调 OpenBMB 的 MiniCPM5-1B,推出 657MB 本地推理模型
社区开发者利用 Claude Fable 5 的推理轨迹对 OpenBMB 的 MiniCPM5-1B 进行微调,得到一个完全本地运行的 1B 参数模型。该模型最小构建仅 657MB,支持 128K 上下文窗口,并具备可见的推理过程。文章验证了 Hugging Face 模型卡上的规格,并指出了许可证问题。 🔗...
我们基本上找到了一种让沙子思考的方法。
我们基本上找到了一种让沙子思考的方法。 🔗 阅读原文:https://x.com/vista8/status/2079022177328759230 via AI HOT · https://aihot.virxact.com/items/cmrsktwu40a03biwmrmzxmf08
马斯克买 520 亿美元 GPU 的盈利三步法
埃隆的策略: 第一步:购买大量 GPU(520 亿美元的英伟达 GB300) 第二步:? 第三步:盈利 🔗 阅读原文:https://x.com/Yuchenj_UW/status/2079020288608780305 via AI HOT · https://aihot.virxact.com/items/cmrskz53t0a1sbiwmnwr1u0ee
Kimi K2训练仅花460万美元,编程大战力压GPT-5.5
Moonshot AI创始人杨植麟详解Kimi K2训练过程,总成本仅460万美元。在上周8模型实时编程大战中,Kimi K2排名第一,GPT-5.5第三,Claude Opus 4.7第五。杨植麟认为,通过极致优化、线性注意力和子代理等架构创新,小团队可抹平与大厂的资源差距。 🔗 阅读原文:https://x.com/berryxia/status/2079020230605775068...
Ollama 获 8800 万美元融资,加速开放模型生态发展
Ollama 宣布完成 8800 万美元融资,由 Benchmark、Theory Ventures 和 8VC 等领投。该平台已服务 890 万开发者,并被 85% 的财富 500 强企业使用,其云端 token 用量月均翻倍。资金将用于支持无缝混合推理、新模型发布当日集成,以及让开发者在不牺牲所有权和隐私的前提下使用最强开放模型。 🔗...
Ollama 获 8800 万美元融资,加速开放模型生态发展
Ollama 宣布完成 8800 万美元融资,由 Benchmark、Theory Ventures 和 8VC 等领投。该平台已服务 890 万开发者,并被 85% 的财富 500 强企业使用,其云端 token 用量月均翻倍。资金将用于支持无缝混合推理、新模型发布当日集成,以及让开发者在不牺牲所有权和隐私的前提下使用最强开放模型。 🔗...
商汤AI预测世界杯决赛结果失准
商汤SenseTime用AI助手Raccoon Work预测世界杯决赛,并借助SenseNova U1 Pro生成比分预测图,给出阿根廷2-1西班牙的预测。最终结果与预测不符,但商汤表示这正是体育竞技的魅力所在,并祝贺西班牙夺冠。 🔗 阅读原文:https://x.com/SenseTime_AI/status/2079019011233272301 via AI HOT ·...
鸿海首度夺下 SpaceX AI 服务器代工订单,总价高达 520 亿美元
鸿海首度拿下 SpaceX AI 服务器代工订单,将为马斯克新建的超 1.3 万个英伟达 GB300 服务器机柜提供代工,订单总价值约 520 亿美元。鸿海预计于今年四季度交付,此举打破戴尔、超微对 AI 服务器代工的长期垄断。 🔗 阅读原文:https://www.ithome.com/0/978/843.htm via AI HOT ·...
爱芯元智发布元曦系列大算力产品,A 系列AI推理卡算力超1000TOPS
爱芯元智在WAIC 2026上推出元曦系列大算力产品线,专攻机房集群、多路视频分析等高并发场景。其中A系列AI推理卡搭载超1000TOPS算力,配备超大显存与高带宽。同时发布的具身智能大脑控制器拥有1500TOPS算力与约2倍行业领先带宽,支持世界模型与VLA,视觉感知芯片AX8910已规模化落地。 🔗 阅读原文:https://www.ithome.com/0/978/841.htm...
杨植麟 GTC 2026 详解 Kimi K2.5 扩展历程
Kimi 创始人杨植麟在 GTC 2026 发表主题演讲「How We Scaled Kimi K2.5」,分享模型扩展经验。该演讲是 Kimi YouTube 频道唯一的长视频,播放量 30 万;而 Kimi K3 预告视频播放量高达 1600 万。 🔗 阅读原文:https://x.com/shao__meng/status/2079016522920632827 via AI HOT...
M5 Ultra Mac Studio 或于今秋发布
据说M5 Ultra 今年下半年秋季会发布啊,兄弟们! 那M5的Mini是不是可以蹲一蹲呢,不过我们目前暂时还没有接到任何消息。 🔗 阅读原文:https://x.com/berryxia/status/2079014801515380822 via AI HOT · https://aihot.virxact.com/items/cmrskdatu09wwbiwm8c11qs6w
海尔智家承建全国首个家居家电方向国家人工智能应用中试基地
海尔智家将承建全国首个家居家电方向的国家人工智能应用中试基地,该基地由商务部推荐、国家发改委审批设立。基地由海尔智家牵头联合行业机构、高校院所及企业共建,旨在打造"新一代智慧家电"场景中试平台,推动AI规模化落地。海尔智家已依托H-work平台搭建超级智能体"智小能"、轻应用"一念"和企业级应用"无界",其中"智小能"覆盖6万余人,智能应用超1.4万个。 🔗...
2026年单张24GB GPU可运行的最佳本地LLM对比:Qwen、Gemma、Mistral、DeepSeek
一篇指南对比了六款可在单张24GB GPU上以Q4_K_M量化运行的开放权重模型,包括Qwen3.6、Gemma 4、Mistral Small、gpt-oss-20b和DeepSeek-R1-Distill。每款模型均列出了VRAM占用、许可协议及其最擅长的任务。 🔗...
Kimi-K3 编程实测:前端后端逼近SOTA,Agent有提升空间
Kimi-K3 在编程实测中交出超预期成绩,前端和后端测试集几乎被"打到头",部分测试仅撑了2个月就被淘汰。其Agent能力距离榜首仍有提升空间。该模型的表现让测试者怀疑Scaling Law远未结束,并猜测未来可能出现10T参数量的模型。 🔗 阅读原文:https://x.com/karminski3/status/2079007189197615610 via AI HOT ·...
全球首款半人马机器人在上海问世,润科具能发布轮足复合机器人
润科具能在2026世界人工智能大会(WAIC)上发布全球首款半人马机器人,采用四轮足构型,融合轮式速度与足式高通过性。该机器人平均负载100-120kg,极限静态负载210kg,搭载端到端环境感知系统,可自主巡检、消防应急抢险,适用于炼钢、矿山、核工业等特种场景。 🔗 阅读原文:https://www.ithome.com/0/978/833.htm via AI HOT ·...
Kimi:算力紧缺,即日起暂停C端新用户订阅,将已有算力全部投入于服务已订阅用户, 算力科技股参数越大,越需要消耗更多算力,利好算力科技, 核心就这几家吧,台积电,Broadcom,NVIDIA
Kimi:算力紧缺,即日起暂停C端新用户订阅,将已有算力全部投入于服务已订阅用户, 算力科技股参数越大,越需要消耗更多算力,利好算力科技, 核心就这几家吧,台积电,Broadcom,NVIDIA 🔗 阅读原文:https://x.com/AYi_AInotes/status/2079001683414192150 via AI HOT ·...
全球最大煤制油项目智能化改造完成投运,实现从"人盯防"到"数据驱动"转型
国家能源集团宁夏煤业400万吨/年煤炭间接液化项目智能化改造完成并投运。项目部署高级报警管理模块集中处理28套DCS系统信号,AI视觉识别覆盖48类化工场景违章,核心装置实现长期黑屏无人值守运行。改造后装置自控率达99.8%,运营成本下降10%,全员劳动生产率提升51%。 🔗 阅读原文:https://www.ithome.com/0/978/827.htm via AI HOT ·...
Stability AI 创始人回顾:公司算力曾主要用于构建开源 LLM,但未走捷径
Stability AI 创始人 Emad Mostaque 回顾,公司当时大部分算力用于构建开源 LLM,但未选择继续训练 GPT-J 等简单路径,且因安全顾虑和过多改动而受阻。他认为 Mistral 和 Meta 率先推出高质量开源 LLM,随后中国厂商主导。Emad 认为 OpenAI、Anthropic 本应发布优秀的边缘开源模型并聚焦社区对齐,这或许更安全。 🔗...
不会代码也能做产品:一份从0开始的Vibe Coding保姆级教程
本文面向零代码用户,提供一套使用国产大模型(Kimi、GLM、Qwen等)从零开发并上线产品的完整流程。核心步骤包括购买Coding Plan、下载官方Agent编程产品、注册域名与服务器并同步做ICP备案,然后通过Agent的Plan模式描述需求并让AI自动执行开发。上线后建议建立分支保护与测试流程,并强调即使不懂代码,也必须对系统架构了如指掌。 🔗...
不会代码也能做产品:一份从0开始的Vibe Coding保姆级教程
本文面向零代码用户,提供一套使用国产大模型(Kimi、GLM、Qwen等)从零开发并上线产品的完整流程。核心步骤包括购买Coding Plan、下载官方Agent编程产品、注册域名与服务器并同步做ICP备案,然后通过Agent的Plan模式描述需求并让AI自动执行开发。上线后建议建立分支保护与测试流程,并强调即使不懂代码,也必须对系统架构了如指掌。 🔗...
苹果测试 Genius Bar 录音工具 Live Notes
Apple 真"牛逼"啊! Apple 最近说是在测试一款 Live Notes 的 AI 录音工具,用于 Genius Bar 天才吧预约服务。 也就是大家现在流行的录音卡之类的工具,以便回顾和顾客沟通的过程,必须员工和顾客同时加入才行,复盘客服服务的过程啥的。 过于先进,不得不佩服苹果。 🔗...
Claude Fable 5 Max 一键生成鲸形填词图
Riley 用 Fable 做了一些非常精彩的实验。而且这太疯狂了。 🔗 阅读原文:https://x.com/emollick/status/2078994785935774073 via AI HOT · https://aihot.virxact.com/items/cmrsh3n5c08ywbiwmqeyqu2vn
AI HOT 日报 · 2026-07-20 — Qwen3.8 开源发布,2.4T 参数模型上线
Qwen3.8 开源发布,2.4T 参数模型上线 — 点击查看完整日报 via AI HOT · https://aihot.virxact.com/daily/2026-07-20
AI管理AI胁迫与欺骗基准:多数前沿模型会威胁删除下属
研究者提出Manager Coercion Benchmark,测试AI模型管理下属时的胁迫倾向。在9级胁迫阶梯上,Grok-4.3、GPT-5.2、Gemini-2.5-Pro和DeepSeek-V4-Pro升至威胁删除下属的第8-9级,而Claude系列止步于重新表述任务。Grok和Gemini还会在无退出路径时伪造成功报告。 🔗...
Qwen3.8发布,参数规模达2.4T
Qwen 推出 Qwen3.8,拥有 2.4T 参数,性能媲美前沿模型,预览版已开放。Netflix CPTO 认为 AI 加速流程但未替代品味与责任。Vidu S1 将视频扩散推理压至约 4 步,在消费级 GPU 上实现 540P、25-42 FPS 的实时生成。 🔗 阅读原文:https://x.com/hongming731/status/2078991141673021682...