RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
联想百应 AI 主机 300 体验:AI Max+395 芯片加持,能跑 120B 本地大模型
联想百应 AI 主机 300 搭载 AMD 锐龙 AI Max+ 395 处理器,集成 Radeon 8060S 显卡与 50 TOPS NPU,板载 128GB LPDDR5x 统一内存(可分配 96GB 显存)。本地部署 OpenClaw 和 Qwen3.6 35B 模型;LM Studio 中 Qwen 3.6 35B 输出 61.66 tok/s,120B 参数的 GPT-OSS...
FORCE倒计时1天|听7位AI资深玩家唠唠,如何用AI拉满生产力
🔗 阅读原文:https://mp.weixin.qq.com/s/9w-YFB6Ff-4GWk3xX5_zuw
邵猛更新国产LLM投票结果:GLM-5.2领先,MiniMax M3垫底
邵猛更新四个国产LLM投票:GLM-5.2获79.7%,DeepSeek V4 13.4%,Kimi K2.7 5.2%,MiniMax M3仅1.7%。他感叹GLM-5.2强势而MiniMax M3惨淡,并指出Gemini 3.5 Flash相比GLM-5.2不能打,Google DeepMind自Gemini 3.0后陷入沉寂。 🔗...
用户 Kim 期待 Sonnet 5 发布
用户 Kim 期待 Sonnet 5 发布,指出 Sonnet 系列常在发布时强于老一代 Opus,如 Claude 3.5 Sonnet 在编程、速度和性价比上超越 Claude 3 Opus。Sonnet 的核心价值是将前沿智能转化为实用工作模型:足够快、足够便宜、足够可靠,支撑实际产品、智能体工作流和日常大规模编码。引用推文暗示本周可能迎来繁忙发布,包括 GPT-5.6 和...
阿里云AI网关FinOps上线
🚀 阿里云AI网关FinOps已上线! • 实时Token可见性与追踪 • 灵活的用户配额与限制 • 即时防止预算超支 让每个Token都物有所值。💰 https://int.alibabacloud.com/m/1000414707/ #AlibabaCloud #AIGateway #FinOps #LLM #DevOps #AIEngineering 🔗...
让大模型从"一问一答"走向"边看边说",京东开源实时视频视觉语言交互模型 JoyAI-VL-Interaction
京东官方宣布开源实时视频视觉语言交互模型 JoyAI-VL-Interaction,这是全球首个全栈开源的 interaction 模型和系统,获 vLLM-Omni day-0...
联想百应 NUC AI Max+395 工作站图赏:金属外壳,简约极客
联想百应 NUC AI Max+395 工作站定位桌面迷你 AI 工作站,适合本地部署大参数 AI 模型与搭建 AI 工作流。机身黑色金属材质,体积约 4.5 升,实测尺寸 202×120×258mm,重 2.9kg,内置 350W 电源。前置接口包括 3.5mm 音频、两个 USB 3.2 Gen2 Type-A、USB4 Type-C、SD 4.0...
想买Mac运行大模型? 这是劝退贴
买MacStudio运行大模型性价比不高。以M3 Ultra 96G(32999元)为例,运行Qwen3.6-27B 4bit量化版并开投机解码,速度约65 token/s。设备成本换算成API调用(GLM-5.2,每百万token 28元)可买约1178M token,需连续运行209天才能回本。512G版(108749元)运行量化GLM-5.2速度仅17...
Sakana AI 推出 Fugu:动态协调多 LLM 的系统,匹配 Anthropic 顶级模型性能
日本 AI 初创公司 Sakana AI 发布 Fugu,一个能动态协调多个大语言模型的系统。Fugu 本身也是一个语言模型,可从可替换的智能体池中调用其他 LLM(含自身副本),通过单一 OpenAI 兼容 API 提供服务。Fugu 有基础版和 Fugu Ultra 变体。Sakana 公布的基准测试显示,Fugu Ultra 在编码、推理、科学和智能体评测中与 Anthropic...
微软 CEO 纳德拉:不能任由 AI 巨头吞噬经济
微软CEO纳德拉向OpenAI、Anthropic等AI巨头发出警告,反对少数公司垄断AI价值并以此索取无限资源。他主张下一阶段AI应转向价格更低的模型,赋予用户更大选择权,并以更可信方式阐述AI社会价值。纳德拉批评前沿模型开发商一边渲染安全风险和失业,一边要求建设大量数据中心。他明确表示,微软不希望AI未来完全由这些公司决定,而应让AI成为企业的知识引擎,由企业灵活调用多种模型,在自有机器...
Sakana AI 发布 Fugu 和 Fugu Ultra 多智能体编排系统
Sakana AI 宣布推出 Fugu 和 Fugu Ultra 系统。Fugu 是一个多智能体编排模型,训练用于操控其他 LLM,通过单一模型 API 访问。其中 Fugu Ultra 在多项基准测试中性能匹敌 Claude Fable 5 和 Mythos 5,并宣称提供前沿能力且规避出口管制风险。该系统目前通过 API 提供服务,但暂不支持 EEA...
Grok将制作好莱坞级电影,指日可待
Grok 终有一天能制作好莱坞级别的电影,而且那一天并不遥远。 🔗 阅读原文:https://x.com/cb_doge/status/2068966792031240383
小米 YU7 GT 自动驾驶挑战纽北成功,央视新闻盛赞
今日,小米 YU7 GT(选配赛道专业套装)搭载自主研发的自动驾驶系统,在全程无人状态下完成纽博格林北环赛道官方计时圈,成绩10分29秒483。央视新闻评论称这是中国新能源汽车蓬勃向上的缩影。小米汽车表示,极限赛道锤炼出的动态模型、高频扭矩分配和毫秒级救车能力将逐步下放到量产车,帮助用户在暴雨、冰雪等极端工况下做出正确决策,将车辆拉回可控范围。 🔗...
CuiMao用seedance2和Grok Imagine Video 1.5制作Fable 5谍战短片
CuiMao使用seedance2与Grok Imagine Video 1.5制作了一部7分钟谍战短片,讲述Fable 5发布后24小时内的虚构事件:Anthropic CEO...
日本计划在17个战略领域向物理AI公私合计投资10.5万亿日元
日本政府6月19日宣布目标到2040财年向17个战略领域公私合计投资超370万亿日元,其中10.5万亿日元分配给物理AI。物理AI将在工业自动化、无人运输、基建巡检等领域发挥作用,以应对人口老龄化加剧带来的劳动力不足。此外,日本上周四公布AI政策草案,旨在通过强化威胁管控和安全评估提升应对高性能AI风险的能力。 🔗 阅读原文:https://www.ithome.com/0/966/967.htm
Sakana Fugu Ultra多智能体编排性能媲美Fable 5
Sakana AI发布Fugu Ultra,它不是传统意义上的前沿模型,而是一个学习编排层,将多个前沿模型转化为协调的智能体团队。其多智能体系统性能可与Fable 5相匹敌。然而,欧洲再次被欧盟委员会排除在访问这一最新SOTA技术之外,引发批评。 🔗 阅读原文:https://x.com/kimmonismus/status/2068960174304338312
用户实测多模型路由:效果远逊GPT 5.5
@LLMJunky 实测某多模型路由服务,5小时使用额度在1个prompt内即告罄。在threejs任务(构建Rocket League副本)中,生成效果远差于GPT 5.5,需7-8次来回通过Codex修复才勉强可玩;GPT 5.5一次完成且无需后续调整,Fable同样表现出色。该路由性能不及Mythos,早期印象不佳。 🔗...
福古(Fugu)订阅与按量付费计划
Fugu 和 Fugu Ultra 提供订阅和按量付费两种计划。订阅三档:Standard 月费 $20,Pro 月费 $100(10 倍用量),Max 月费 $200(20 倍)。按量付费按 token 计费,不叠加多 agent 费用。Fugu Ultra(fugu-ultra-20260615)每 1M token 定价:输入 $5、输出 $30、缓存输入 $0.50;上下文超过...
MoonMath AI 开源 AMD MI300X 注意力核,全面超越 AITER v3
MoonMath AI 团队开源了一款 bf16 前向注意力核,专为 AMD MI300X(gfx942)设计,使用 HIP 编写,MIT 许可。该核在所有测试形状和三种舍入模式下均超越 AMD 官方 AITER v3:几何平均加速比 1.18×(RTNE)、1.15×(RTNA)、1.08×(RTZ),最高单形状 1.26×。性能提升来自单指令 asm 包装和内存布局优化--K 置于...
华为智慧屏推送系统更新:新增儿童时长管控、畅连小窗调节等
华为智慧屏今日推送系统更新,主要新增或优化:标准模式新增儿童时长管控(设置>通用>使用时间管理);畅连小窗支持自由调节窗口大小;观看影视剧时可呼叫小艺进行人物、剧情等问答;超级桌面分辨率由1080P提升至2K;遥控器支持控制外接设备(需开启CEC);开关机菜单支持自定义预设焦点;智慧屏可与全屋吸顶音箱联动;AI语音唤醒准确率和响应时延优化;门锁画中画联动显示接听设备名称及位置,并支持挂断。官...
Sakana Fugu Ultra:多智能体编排系统对标Fable和Mythos
Sakana AI 推出 Fugu 多智能体编排系统,通过单一模型 API 调用即可协调多个前沿模型组成智能体团队。其 Fugu Ultra 模型性能与 Fable、Mythos 相当,且不受出口管制限制。主推文指出,Fugu Ultra 并非传统意义上的新基座模型,而是一个学习到的编排层,更智能的测试时编排可能是 AI 能力的下一个跃升点。 🔗...
Recall:Claude Code 的本地项目记忆工具
Recall 是为 Claude Code 设计的完全本地项目记忆工具。它自动记录每次会话日志(history.md),并通过 TF-IDF + TextRank 提取式摘要算法在本地生成压缩摘要(context.md,约 1-2K token),无需调用任何外部模型或 API 密钥。摘要完全在本地完成,不消耗 Claude Code 的模型...
小米汽车谈为何用自动驾驶挑战纽北:试探极限边缘,为了日常的安全保驾护航
小米汽车今日宣布,小米 YU7 GT 以 10 分 29 秒 483 的成绩达成全球首个纽北自动驾驶圈速纪录。小米汽车官方表示,这一圈速并非 YU7 GT 的硬件极限或智能驾驶算法能力的终点。选择纽北赛道,旨在通过极限赛道锤炼动态模型、高频扭矩分配和毫秒级救车能力,最终将这些能力逐步下放到普通用户的量产车上,帮助用户在暴雨、冰雪等极端工况下做出正确决策,将车辆拉回可控范围。 🔗...
特斯拉开始训练卡车版FSD?Semi电动重卡搭载真值校验设备现身
特斯拉Semi电动重卡被拍到搭载基准真值校验设备,现身加利福尼亚州森尼韦尔市。该设备常用于特斯拉监督式算法训练,表明特斯拉正在为商用车型完善FSD模型。此举有望缓解卡车司机的驾驶时长限制,对物流行业具有里程碑意义。不过落地可能面临技术挑战,类似Cybertruck的FSD因摄像头高度问题延迟,近期才获得真智能召唤(ASS)功能。 🔗...
微调 Qwen 3:0.6B 实现家庭问题分类,准确率从 10% 提升至 92%
一个个人项目通过微调仅 600M 参数的 Qwen 3:0.6B 模型,将其作为家庭问题分类器。基线测试中,仅靠提示词的原始模型在 131 条测试中仅正确分类 13 条(约 10%)。使用 Unsloth 框架和 QLoRA 微调后,准确率提升至 79%。进一步将分类标签改为无语义重叠的两字符不透明 ID(如 hvac 改为固定代码),准确率升至约 92%。训练数据集约 850 条,按...
阿里巴巴发布视频生成模型 HappyHorse 1.1
阿里巴巴今日发布视频生成模型 HappyHorse 1.1,在动态表现力、主体一致性、指令遵循、视觉质感和音频能力等维度系统性升级。技术规格与 1.0 版本一致,单次生成 3 到 15 秒,支持 720p 和 1080p 分辨率及自由宽高比。HappyHorse 官网、阿里云百炼和千问云均已接入最新版本。同日,HappyHorse 联合虎鲸文娱集团启动"Horsepower"AI...
Guinness Chen:用语音输入代替手动编辑提示词
Guinness Chen 表示,2026年6月了,别再手动编辑提示词,应该按住听写按钮即兴说上10分钟,把脑海里的每个碎片、警告、例子和感觉都交给模型--大语言模型最擅长的就是从语言中重建潜在意图。Jason Liu 称赞他只发好内容,观点总是很棒,并建议大家关注他 @guinnesschen。 🔗 阅读原文:https://x.com/jxnlco/status/2068949888784851140
DeepSWE 基准测试发布,GLM-5.2 与 Kimi-K2.7-Code 分别成为国产编程 SOTA 与性价比 SOTA
DeepSWE 基准测试发布榜单,GLM-5.2 为国产编程大模型 SOTA,Kimi-K2.7-Code 为性价比 SOTA。该榜单与 SWE-Bench-verified 不同:问题由人工针对开源项目制造,可避免数据泄露;每个问题需修改上百行代码,考验模型规划能力,且不提供工具指引,更贴近真实工程场景。覆盖 TypeScript、Go、Python、JavaScript、Rust...