RSS

  • 宝玉的分享
    https://baoyu.io/feed.xml
    刷新于
  • AIHOT 日报
    https://aihot.virxact.com/feed/daily.xml
    刷新于
  • AIHOT — 全部 AI 动态
    https://aihot.virxact.com/feed/all.xml
    刷新于
  • AIHOT — 精选
    https://aihot.virxact.com/feed.xml
    刷新于

Gemini 3.1 Flash Lite Image 上线 AI Studio

Google 在 AI Studio 发布 Gemini 3.1 Flash Lite Image(内部代号 Nano Banana 2 Lite),定位最小、最经济的图像生成与编辑模型,适合大规模使用。输入价格 $0.25,输出价格 $0.0336。该模型此前曾以"超快、高性价比图像生成"之名预告,同期预告的还有支持对话式逐步视频编辑的 Gemini Omni Flash。 🔗...

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))

Cloudflare 新增 Browser Rendering 远程 Chromium 抓取功能

Cloudflare 新增 Browser Rendering,提供远程 Chromium 抓取。Workers Paid $5/月含 10 小时浏览器/天。作者将 AI 公司官网抓取从 Jina Reader 迁至 Cloudflare,实际日耗约 3 分钟,99%+ 余量未用,避免了 Jina 免费层耗尽后的 402 静默失败问题,价格从 token 计费变为 $5 封顶可预测。结合...

noreply@aihot.virxact.com (X:小北 (@frxiaobei))

Libby 将推出 AI 内容过滤功能,依赖出版商自我标注

电子书借阅应用 Libby 即将引入 AI 内容控制功能,允许用户在设置中选择是否查看 AI 生成内容,涵盖 AI 创作、AI 旁白有声书、机器翻译和 AI 生成艺术。OverDrive 新任 CEO Marc DeBevoise 表示,过滤依赖出版商通过标准化元数据进行自我标注,而非使用 AI 检测工具。Libby 目录超 600 万本书,借阅超 10 亿次,多数为 2020...

noreply@aihot.virxact.com (The Verge:AI(RSS))

华为"博观文旅大模型"在西安规模应用

2026年6月29日,华为与陕文投联合开发的全球首个商用多模态文旅大模型"博观文旅大模型"在西安实现规模化应用。截至今年3月,其AI伴游智能体已覆盖超400万用户,非遗数字IP衍生产品销售额超200万元。该模型依托昇腾算力底座及超1.2PB数据集(含3100万张文旅图片等),支持高精度多模态历史内容生成,实现文物活化与非遗IP开发。同期,中国电信陕西公司与华为在大唐不夜城部署5G-A网络,上...

noreply@aihot.virxact.com (IT之家(RSS))

美团发布LongCat-2.0,1.6万亿参数大模型完全基于国产芯片训练

美团发布LongCat-2.0,参数规模达1.6万亿,完全基于超5万颗国产AI ASIC芯片集群训练,覆盖35万亿模型token。该模型在SWE-bench Pro(59.5)和SWE-bench Multilingual(77.3)上超越Gemini 3.1 Pro和GPT-5.5,但落后于Claude Opus...

noreply@aihot.virxact.com (The Decoder:AI News(RSS))

Etched走出隐身:融资8亿美元,SOTA推理机架今夏发货

Etched正式走出隐身模式,宣布已融资8亿美元,并签下超过10亿美元的客户合同。成功完成A0流片后,首批推理机架已制造完成,预计今年夏天发货。早期客户测试显示,其在推理吞吐量、延迟和能效方面均达到SOTA水平。投资方阵容堪称AI研究员与VC的全明星阵容。 🔗 阅读原文:https://x.com/kimmonismus/status/2071976332628537834

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

Apify与Coinbase合作:x402生态工具池扩至2万+

Apify与Coinbase合作,将超过20,000个Web自动化Actors接入x402生态系统。AI智能体可自主发现、支付并运行这些工具:调用Actor时收到HTTP 402状态码,通过Base链上的USDC完成支付后立即执行。此前x402生态仅有约2,000个工具(来自@apify),此次合作将可用工具数量提升10倍,无需账户、API密钥或人工介入。 🔗...

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))

Apptronik建成近9万平方英尺机器人实训园,Apollo通过实操训练优化AI模型

人形机器人公司Apptronik在奥斯汀建成近9万平方英尺(约8361平方米)的机器人实训园,其Apollo机器人通过远程操控反复进行装箱、分拣等实操训练,数据用于优化AI模型。公司累计融资约10亿美元,估值超55亿美元。投资方梅赛德斯-奔驰已在工厂部署Apollo,谷歌DeepMind借助Apollo改进机器人AI模型Gemini...

noreply@aihot.virxact.com (IT之家(RSS))

X推出托管MCP服务器,简化AI工具接入平台

X本周一推出托管MCP服务器,允许Claude、Cursor、Grok Build等MCP兼容AI助手通过用户自己的账户权限直接连接X API。MCP是开放标准,用于AI模型连接外部工具。此前开发者需自建托管MCP服务器,现在由X托管,简化集成。该服务器不新增API能力,仅使已有功能更易被AI调用。X借此定位为实时数据检索网络。X还更新了API...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

CodePilot 0.5.6.3更新,上线ClinePass及Opencode GO套餐

CodePilot 0.5.6.3已更新,新增ClinePass和Opencode GO两个Codeplan套餐。此外,Cline推出每月9.9美元的token plan,支持DeepSeek、Kimi、MiniMax、MIMO、通义千问以及GLM5.2,目前还有1.99美元的优惠价。这类聚合token plan在海外逐渐增多,便于调用多家推理服务。 🔗...

noreply@aihot.virxact.com (X:歸藏 (@op7418))

OpenClaw移动端上线,用户称仅耗token

OpenClaw现已登陆iOS和Android,终于推出原生移动应用,可将Agent装进口袋,随时管理频道、任务和回复。用户@小北体验后评价:"继续加油吧!这个软件唯一的价值就是消耗了一大堆token。" 🔗 阅读原文:https://x.com/frxiaobei/status/2071974132972163270

noreply@aihot.virxact.com (X:小北 (@frxiaobei))

美团低调发布基座推理模型LongCat-2.0,MoE架构1.6T参数

美团发布基座推理模型LongCat-2.0(v2),采用MoE架构,总参1.6T,活跃约48B,支持1M上下文。专为智能体编程设计,引入LongCat Sparse Attention、Zero-Compute Experts及MOPD任务路由。基准测试中SWE-bench...

noreply@aihot.virxact.com (X:Nathan Lambert (@natolambert))

Apify x402将智能体工具库扩至2万+

自主智能体可规划和调用API,但无法获取未授权工具。x402协议与Apify的20,000+个Actors解决了这一缺口。此前智能体仅可通过x402购买约2,000个工具,如今Apify与Coinbase合作,将其10倍扩展至20,000+个,为自主智能体提供最大的网络自动化工具市场。无需账户、API密钥或人工介入。 🔗...

noreply@aihot.virxact.com (X:Elvis Saravia (@omarsar0, DAIR.AI))

Peter Steinberger澄清:OpenClaw未被OpenAI收购,希望获得建设性帮助

针对用户Cristian嘲讽"被OpenAI收购、拿到无限token却做出劣质应用"的推文,Peter Steinberger回应:OpenClaw未被收购,它是OpenClaw Foundation下的独立开源项目,由社区构建;OpenAI仅赞助token用量,他本人恰好在OpenAI工作。当前iOS和Android应用尚不完善,但已实现安全配对和推送通知并通过App...

noreply@aihot.virxact.com (X:Peter Steinberger (@steipete))

可灵Kling AI致敬六月创作者

像金鱼在水中闪烁一样,每个想法都留下一丝色彩。✨ 那些为我们的六月染上色彩的创作者们。 🔗 阅读原文:https://x.com/Kling_ai/status/2071972026508538166

noreply@aihot.virxact.com (X:可灵 Kling AI (@Kling_ai))

Riverside 推出新闻通讯功能,支持 AI 转换播客视频为内容

视频与播客录制工具 Riverside 新增新闻通讯发布功能,用户可通过 AI 助手将已有视频和播客内容自动转换为新闻通讯,也可在应用内从头创建并直接发送。Riverside 同时更新录制套件,支持多机位录制和远程嘉宾添加。新版 AI 功能还包括自动生成录制初稿、为社交媒体创建钩子与内容,以及基于对话视频播客训练的 AI 视频增强功能,可改善光线、深度和锐度。Riverside...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

亚马逊推出10亿美元FDE新部门,紧随OpenAI和Anthropic

AWS成立了一个10亿美元的AI前向部署工程师(FDE)新部门。该团队工程师将嵌入客户公司,部署定制化agent系统,注重快速响应和客户自给自足,帮助客户获得可持续的AI技能和工作流。FDE模式由Palantir开创。此前,OpenAI和Anthropic也分别推出了40亿美元和15亿美元的FDE合资企业。 🔗...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

Sonnet 5 已出,发布在即

Sonnet 5 已出现在模型选择器中。 发布在即。 🔗 阅读原文:https://x.com/kimmonismus/status/2071971743556628668

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

谷歌 Nano Banana 2 Lite 已用于 Gemini Flash Lite 选项

GOOGLE 🔥: 如果你从下拉菜单中选择 Flash Lite 选项,Nano Banana 2 Lite 已在 Gemini 中使用。 h/t @BartokGabi17 🔗 阅读原文:https://x.com/testingcatalog/status/2071971564174623202

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))

Acti 智能体键盘发布:每个文本字段中的隐形智能体

Acti (@openacti1) 推出 Agentic Keyboard(智能体键盘),定位为继 2007 年苹果玻璃键盘后的下一次变革。它不是语法修正或语音转写工具,而是在每个文本字段中嵌入隐形智能体。用户输入内容后按住即可运行,结果直接返回,无需离开当前对话。支持将自定义工作流绑定到技能键并即时触发。推文作者认为这是今年智能体领域最有趣的创新之一,称键盘是 AI 理想的载体形式。 🔗...

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

美团LongCat发布LongCat-2.0:1.6T参数MoE,1M上下文,专为智能体编码设计

美团LongCat正式发布LongCat-2.0,采用1.6T参数MoE架构,约48B活跃参数,支持1M上下文窗口。专为智能体编码设计,核心创新包括:LongCat稀疏注意力(LSA)高效扩展1M上下文;零计算专家(33B-56B动态激活,无浪费);MOPD混合专家组(按任务路由至Agent/Reasoning/Interaction)。基准测试:Terminal-Bench...

noreply@aihot.virxact.com (X:Nathan Lambert (@natolambert))

单芯片混合精度浮点算力达 896TFLOPS,中昊芯英新一代 TPU 芯片「须臾」发布

中昊芯英发布新一代全自研 TPU 芯片「须臾」,单芯片混合精度浮点算力 896 TFLOPS,为上一代「刹那」3 倍;8-bit 推理算力 1792 TOPS。单卡功耗 600W,较传统芯片降低 50%。同步推出智算底座「泰则 2.0」,搭载两路 CPU 与 8 片 TPU,混合精度算力 7.168P,整机能耗为传统 GPU 服务器 80%。平台原生支持...

noreply@aihot.virxact.com (IT之家(RSS))

Flowith 推出「Matrix」:Agent 公司的操作系统,用户定使命,多Agent部门长期运转

Flowith 团队发布「Matrix」,定位为自演化、多层级的 multi-agent runtime。用户设定使命后,Matrix 通过 CEO Office → OKR 分解任务,驱动多个 Agent 部门(Research/Engineering/Growth/Product)并行执行,并以 proof(文件、上线页面、收入等)闭环。架构包含 Runtime 层(独立...

noreply@aihot.virxact.com (X:邵猛 (@shao__meng))

ByteDance 推 Seed Audio 1.0:多模态音频生成模型

ByteDance 通过 BytePlus 推出 Seed Audio 1.0,一个非流式 TTS 模型,可在一次生成中同时输出语音、音乐和音效。支持参考音频引导、图像引导音频,以及语速、音量、音调等精细控制。与传统仅生成语音的 TTS 不同,它更像多模态音频生成模型,一次性完成复杂场景音频。目前仅对企业开放申请,早期反馈音频自然,但缺少对时长的精细控制。 🔗...

noreply@aihot.virxact.com (X:Berry Xia (@berryxia))

专业化为何不可避免

Dharma AI 团队引述 Goldfeder、Wyder、LeCun 和 Shwartz-Ziv 于 2026 年发表的论文,从优化理论、生物学和竞争市场论证专业化的必然性。Wolpert-Macready...

noreply@aihot.virxact.com (Hugging Face:Blog(RSS))

Bristol项目:将报告变成可交互可视化HTML

由 LayerProof 推出的 Bristol 项目,旨在用可交互 HTML 报告替代传统静态 PDF。用户可上传数据后通过聊天调整分析角度、语气和图表,支持视觉编辑器点选修改。每个数字可溯源,支持实时更新。其"可视化处理"据称比纯文本处理快 6 万倍,更擅长图表驱动的数据叙事,适合咨询、分析、运营团队制作持续可互动的报告资产。 🔗...

noreply@aihot.virxact.com (X:Berry Xia (@berryxia))

消息称 OpenAI 通过系统底层优化,将 AI 模型推理成本减半

OpenAI 工程师在内部透露,公司通过一系列系统底层优化,将 AI 模型的推理(运行)成本降低了 50% 以上。此次优化主要得益于提升现有服务器资源利用率,而非新增计算芯片投入,使得所需英伟达芯片更少。节省的成本可用于降低 API 定价或提高用户使用限额。 🔗 阅读原文:https://www.ithome.com/0/970/771.htm

noreply@aihot.virxact.com (IT之家(RSS))

开放模型扩展的推荐阅读

推荐阅读,如果你正在使用开放模型进行扩展。 顺便说一句,你应该思考如何使用开放权重模型进行扩展。 🔗 阅读原文:https://x.com/omarsar0/status/2071964811684974815

noreply@aihot.virxact.com (X:Elvis Saravia (@omarsar0, DAIR.AI))

JetSpec:因果并行树草稿投机解码方法

JetSpec 是一种投机解码方法,通过因果并行树草稿联合优化草稿成本与质量,采用并行草稿树和树因果验证。在 MATH-500 上实现 9.64x 端到端加速,开放聊天场景达 4.58x 加速,且保持无损。结合 CUDA graph 与内核优化,单块 B200 可实现约 1000 TPS。SemiAnalysis 期待其与推理引擎 vLLM/SGLang 的深度集成。 🔗...

noreply@aihot.virxact.com (X:SemiAnalysis (@SemiAnalysis_))

Fireworks AI 推出 Serverless 2.0,通过三种服务层级解决 503 拒绝请求问题

Fireworks AI 推出 Serverless 2.0,通过同一 API 端点下的三种服务层级解决共享集群高负载时的 503 Service Overloaded 问题。Standard 为默认经济型;Priority 在拥塞时提供更强准入,价格更高;Fast 通过优化路径提升生成 token 吞吐量,适用于低延迟场景。推荐默认使用 Standard,遇到 503 时临时切换...

noreply@aihot.virxact.com (X:Elvis Saravia (@omarsar0, DAIR.AI))
上一页 第 527 / 972 页 下一页

添加 Feed

导入 OPML