RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
Gemini 3.1 Flash Lite Image 上线 AI Studio
Google 在 AI Studio 发布 Gemini 3.1 Flash Lite Image(内部代号 Nano Banana 2 Lite),定位最小、最经济的图像生成与编辑模型,适合大规模使用。输入价格 $0.25,输出价格 $0.0336。该模型此前曾以"超快、高性价比图像生成"之名预告,同期预告的还有支持对话式逐步视频编辑的 Gemini Omni Flash。 🔗...
Cloudflare 新增 Browser Rendering 远程 Chromium 抓取功能
Cloudflare 新增 Browser Rendering,提供远程 Chromium 抓取。Workers Paid $5/月含 10 小时浏览器/天。作者将 AI 公司官网抓取从 Jina Reader 迁至 Cloudflare,实际日耗约 3 分钟,99%+ 余量未用,避免了 Jina 免费层耗尽后的 402 静默失败问题,价格从 token 计费变为 $5 封顶可预测。结合...
Libby 将推出 AI 内容过滤功能,依赖出版商自我标注
电子书借阅应用 Libby 即将引入 AI 内容控制功能,允许用户在设置中选择是否查看 AI 生成内容,涵盖 AI 创作、AI 旁白有声书、机器翻译和 AI 生成艺术。OverDrive 新任 CEO Marc DeBevoise 表示,过滤依赖出版商通过标准化元数据进行自我标注,而非使用 AI 检测工具。Libby 目录超 600 万本书,借阅超 10 亿次,多数为 2020...
华为"博观文旅大模型"在西安规模应用
2026年6月29日,华为与陕文投联合开发的全球首个商用多模态文旅大模型"博观文旅大模型"在西安实现规模化应用。截至今年3月,其AI伴游智能体已覆盖超400万用户,非遗数字IP衍生产品销售额超200万元。该模型依托昇腾算力底座及超1.2PB数据集(含3100万张文旅图片等),支持高精度多模态历史内容生成,实现文物活化与非遗IP开发。同期,中国电信陕西公司与华为在大唐不夜城部署5G-A网络,上...
美团发布LongCat-2.0,1.6万亿参数大模型完全基于国产芯片训练
美团发布LongCat-2.0,参数规模达1.6万亿,完全基于超5万颗国产AI ASIC芯片集群训练,覆盖35万亿模型token。该模型在SWE-bench Pro(59.5)和SWE-bench Multilingual(77.3)上超越Gemini 3.1 Pro和GPT-5.5,但落后于Claude Opus...
Etched走出隐身:融资8亿美元,SOTA推理机架今夏发货
Etched正式走出隐身模式,宣布已融资8亿美元,并签下超过10亿美元的客户合同。成功完成A0流片后,首批推理机架已制造完成,预计今年夏天发货。早期客户测试显示,其在推理吞吐量、延迟和能效方面均达到SOTA水平。投资方阵容堪称AI研究员与VC的全明星阵容。 🔗 阅读原文:https://x.com/kimmonismus/status/2071976332628537834
Apify与Coinbase合作:x402生态工具池扩至2万+
Apify与Coinbase合作,将超过20,000个Web自动化Actors接入x402生态系统。AI智能体可自主发现、支付并运行这些工具:调用Actor时收到HTTP 402状态码,通过Base链上的USDC完成支付后立即执行。此前x402生态仅有约2,000个工具(来自@apify),此次合作将可用工具数量提升10倍,无需账户、API密钥或人工介入。 🔗...
Apptronik建成近9万平方英尺机器人实训园,Apollo通过实操训练优化AI模型
人形机器人公司Apptronik在奥斯汀建成近9万平方英尺(约8361平方米)的机器人实训园,其Apollo机器人通过远程操控反复进行装箱、分拣等实操训练,数据用于优化AI模型。公司累计融资约10亿美元,估值超55亿美元。投资方梅赛德斯-奔驰已在工厂部署Apollo,谷歌DeepMind借助Apollo改进机器人AI模型Gemini...
X推出托管MCP服务器,简化AI工具接入平台
X本周一推出托管MCP服务器,允许Claude、Cursor、Grok Build等MCP兼容AI助手通过用户自己的账户权限直接连接X API。MCP是开放标准,用于AI模型连接外部工具。此前开发者需自建托管MCP服务器,现在由X托管,简化集成。该服务器不新增API能力,仅使已有功能更易被AI调用。X借此定位为实时数据检索网络。X还更新了API...
CodePilot 0.5.6.3更新,上线ClinePass及Opencode GO套餐
CodePilot 0.5.6.3已更新,新增ClinePass和Opencode GO两个Codeplan套餐。此外,Cline推出每月9.9美元的token plan,支持DeepSeek、Kimi、MiniMax、MIMO、通义千问以及GLM5.2,目前还有1.99美元的优惠价。这类聚合token plan在海外逐渐增多,便于调用多家推理服务。 🔗...
OpenClaw移动端上线,用户称仅耗token
OpenClaw现已登陆iOS和Android,终于推出原生移动应用,可将Agent装进口袋,随时管理频道、任务和回复。用户@小北体验后评价:"继续加油吧!这个软件唯一的价值就是消耗了一大堆token。" 🔗 阅读原文:https://x.com/frxiaobei/status/2071974132972163270
美团低调发布基座推理模型LongCat-2.0,MoE架构1.6T参数
美团发布基座推理模型LongCat-2.0(v2),采用MoE架构,总参1.6T,活跃约48B,支持1M上下文。专为智能体编程设计,引入LongCat Sparse Attention、Zero-Compute Experts及MOPD任务路由。基准测试中SWE-bench...
Apify x402将智能体工具库扩至2万+
自主智能体可规划和调用API,但无法获取未授权工具。x402协议与Apify的20,000+个Actors解决了这一缺口。此前智能体仅可通过x402购买约2,000个工具,如今Apify与Coinbase合作,将其10倍扩展至20,000+个,为自主智能体提供最大的网络自动化工具市场。无需账户、API密钥或人工介入。 🔗...
Peter Steinberger澄清:OpenClaw未被OpenAI收购,希望获得建设性帮助
针对用户Cristian嘲讽"被OpenAI收购、拿到无限token却做出劣质应用"的推文,Peter Steinberger回应:OpenClaw未被收购,它是OpenClaw Foundation下的独立开源项目,由社区构建;OpenAI仅赞助token用量,他本人恰好在OpenAI工作。当前iOS和Android应用尚不完善,但已实现安全配对和推送通知并通过App...
可灵Kling AI致敬六月创作者
像金鱼在水中闪烁一样,每个想法都留下一丝色彩。✨ 那些为我们的六月染上色彩的创作者们。 🔗 阅读原文:https://x.com/Kling_ai/status/2071972026508538166
Riverside 推出新闻通讯功能,支持 AI 转换播客视频为内容
视频与播客录制工具 Riverside 新增新闻通讯发布功能,用户可通过 AI 助手将已有视频和播客内容自动转换为新闻通讯,也可在应用内从头创建并直接发送。Riverside 同时更新录制套件,支持多机位录制和远程嘉宾添加。新版 AI 功能还包括自动生成录制初稿、为社交媒体创建钩子与内容,以及基于对话视频播客训练的 AI 视频增强功能,可改善光线、深度和锐度。Riverside...
亚马逊推出10亿美元FDE新部门,紧随OpenAI和Anthropic
AWS成立了一个10亿美元的AI前向部署工程师(FDE)新部门。该团队工程师将嵌入客户公司,部署定制化agent系统,注重快速响应和客户自给自足,帮助客户获得可持续的AI技能和工作流。FDE模式由Palantir开创。此前,OpenAI和Anthropic也分别推出了40亿美元和15亿美元的FDE合资企业。 🔗...
Sonnet 5 已出,发布在即
Sonnet 5 已出现在模型选择器中。 发布在即。 🔗 阅读原文:https://x.com/kimmonismus/status/2071971743556628668
谷歌 Nano Banana 2 Lite 已用于 Gemini Flash Lite 选项
GOOGLE 🔥: 如果你从下拉菜单中选择 Flash Lite 选项,Nano Banana 2 Lite 已在 Gemini 中使用。 h/t @BartokGabi17 🔗 阅读原文:https://x.com/testingcatalog/status/2071971564174623202
Acti 智能体键盘发布:每个文本字段中的隐形智能体
Acti (@openacti1) 推出 Agentic Keyboard(智能体键盘),定位为继 2007 年苹果玻璃键盘后的下一次变革。它不是语法修正或语音转写工具,而是在每个文本字段中嵌入隐形智能体。用户输入内容后按住即可运行,结果直接返回,无需离开当前对话。支持将自定义工作流绑定到技能键并即时触发。推文作者认为这是今年智能体领域最有趣的创新之一,称键盘是 AI 理想的载体形式。 🔗...
美团LongCat发布LongCat-2.0:1.6T参数MoE,1M上下文,专为智能体编码设计
美团LongCat正式发布LongCat-2.0,采用1.6T参数MoE架构,约48B活跃参数,支持1M上下文窗口。专为智能体编码设计,核心创新包括:LongCat稀疏注意力(LSA)高效扩展1M上下文;零计算专家(33B-56B动态激活,无浪费);MOPD混合专家组(按任务路由至Agent/Reasoning/Interaction)。基准测试:Terminal-Bench...
单芯片混合精度浮点算力达 896TFLOPS,中昊芯英新一代 TPU 芯片「须臾」发布
中昊芯英发布新一代全自研 TPU 芯片「须臾」,单芯片混合精度浮点算力 896 TFLOPS,为上一代「刹那」3 倍;8-bit 推理算力 1792 TOPS。单卡功耗 600W,较传统芯片降低 50%。同步推出智算底座「泰则 2.0」,搭载两路 CPU 与 8 片 TPU,混合精度算力 7.168P,整机能耗为传统 GPU 服务器 80%。平台原生支持...
Flowith 推出「Matrix」:Agent 公司的操作系统,用户定使命,多Agent部门长期运转
Flowith 团队发布「Matrix」,定位为自演化、多层级的 multi-agent runtime。用户设定使命后,Matrix 通过 CEO Office → OKR 分解任务,驱动多个 Agent 部门(Research/Engineering/Growth/Product)并行执行,并以 proof(文件、上线页面、收入等)闭环。架构包含 Runtime 层(独立...
ByteDance 推 Seed Audio 1.0:多模态音频生成模型
ByteDance 通过 BytePlus 推出 Seed Audio 1.0,一个非流式 TTS 模型,可在一次生成中同时输出语音、音乐和音效。支持参考音频引导、图像引导音频,以及语速、音量、音调等精细控制。与传统仅生成语音的 TTS 不同,它更像多模态音频生成模型,一次性完成复杂场景音频。目前仅对企业开放申请,早期反馈音频自然,但缺少对时长的精细控制。 🔗...
专业化为何不可避免
Dharma AI 团队引述 Goldfeder、Wyder、LeCun 和 Shwartz-Ziv 于 2026 年发表的论文,从优化理论、生物学和竞争市场论证专业化的必然性。Wolpert-Macready...
Bristol项目:将报告变成可交互可视化HTML
由 LayerProof 推出的 Bristol 项目,旨在用可交互 HTML 报告替代传统静态 PDF。用户可上传数据后通过聊天调整分析角度、语气和图表,支持视觉编辑器点选修改。每个数字可溯源,支持实时更新。其"可视化处理"据称比纯文本处理快 6 万倍,更擅长图表驱动的数据叙事,适合咨询、分析、运营团队制作持续可互动的报告资产。 🔗...
消息称 OpenAI 通过系统底层优化,将 AI 模型推理成本减半
OpenAI 工程师在内部透露,公司通过一系列系统底层优化,将 AI 模型的推理(运行)成本降低了 50% 以上。此次优化主要得益于提升现有服务器资源利用率,而非新增计算芯片投入,使得所需英伟达芯片更少。节省的成本可用于降低 API 定价或提高用户使用限额。 🔗 阅读原文:https://www.ithome.com/0/970/771.htm
开放模型扩展的推荐阅读
推荐阅读,如果你正在使用开放模型进行扩展。 顺便说一句,你应该思考如何使用开放权重模型进行扩展。 🔗 阅读原文:https://x.com/omarsar0/status/2071964811684974815
JetSpec:因果并行树草稿投机解码方法
JetSpec 是一种投机解码方法,通过因果并行树草稿联合优化草稿成本与质量,采用并行草稿树和树因果验证。在 MATH-500 上实现 9.64x 端到端加速,开放聊天场景达 4.58x 加速,且保持无损。结合 CUDA graph 与内核优化,单块 B200 可实现约 1000 TPS。SemiAnalysis 期待其与推理引擎 vLLM/SGLang 的深度集成。 🔗...
Fireworks AI 推出 Serverless 2.0,通过三种服务层级解决 503 拒绝请求问题
Fireworks AI 推出 Serverless 2.0,通过同一 API 端点下的三种服务层级解决共享集群高负载时的 503 Service Overloaded 问题。Standard 为默认经济型;Priority 在拥塞时提供更强准入,价格更高;Fast 通过优化路径提升生成 token 吞吐量,适用于低延迟场景。推荐默认使用 Standard,遇到 503 时临时切换...