RSS

  • 宝玉的分享
    https://baoyu.io/feed.xml
    刷新于
  • AIHOT 日报
    https://aihot.virxact.com/feed/daily.xml
    刷新于
  • AIHOT — 全部 AI 动态
    https://aihot.virxact.com/feed/all.xml
    刷新于
  • AIHOT — 精选
    https://aihot.virxact.com/feed.xml
    刷新于

Claude Fable实地指南:发现你的未知

Claude Fable是第一款要求用户主动澄清未知才能获得高质量工作的模型。与Claude Fable协作是一个在实现前后迭代发现未知的过程。通过将问题分解为已知的已知、已知的未知、未知的已知和未知的未知四类,用户可以借助Claude Fable和Claude Code进行盲点检查、头脑风暴、原型设计、实现笔记记录以及答辩解释,从而高效挖掘并解决深藏于代码库和设计与实现中的潜在问题。 🔗...

noreply@aihot.virxact.com (Claude:Blog(网页))

ThinkingCap-Qwen3.6-27B思考token减半

bottlecapai/ThinkingCap-Qwen3.6-27B Qwen3.6-27B 的能力:平均减少 50% 的思考 token,最佳情况下减少超过 90%。通过对 Qwen3.6-27B(Qwen Team, 2026)进行微调实现,使用了最先进的微调算法,并在精心挑选的涵盖不同领域和难度的数据集上训练。 🔗...

noreply@aihot.virxact.com (X:AK (@_akhaliq))

OpenAI DevDay 2026 本周报名截止

本周截止。许多构建 ChatGPT、Codex 和 OpenClaw 的团队将出席,我们还会给大家带来一些惊喜。希望能见到你们中的许多人 👀 🔗 阅读原文:https://x.com/thsottiaux/status/2074195169990357398 via AI HOT · https://aihot.virxact.com/items/cmr9jo4ms00f1ihe8wxas1rbh

noreply@aihot.virxact.com (X:Tibo (@thsottiaux))

Artificial Analysis 与 Zapier 联合发布 AutomationBench-AA 独立排行榜

Artificial Analysis 与 Zapier 合作推出 AutomationBench-AA 排行榜,测试 AI 智能体在真实 SaaS 工作流中遵循业务规则的自动化能力。基准包含 657 项任务,覆盖财务、HR、销售等 6 部门,在 40 个模拟应用(Gmail、Slack、Salesforce 等)中运行。模型通过 REST API 自主发现端点,按近 12,000...

noreply@aihot.virxact.com (X:Artificial Analysis (@ArtificialAnlys))

腾讯发布开源MoE模型Hy3,性能声称匹敌5倍规模

腾讯正式发布开源MoE模型Hy3,总参数295B,活跃参数21B,另有3.8B MTP层,上下文窗口256k token。官方称其性能可比肩两到五倍规模模型。270位专家盲评中Hy3得分2.67/4,超越GLM-5.1的2.51;内部测试幻觉率从12.5%降至5.4%。Hy3以Apache 2.0许可在Hugging...

noreply@aihot.virxact.com (The Decoder:AI News(RSS))

LLM强化学习:单调推理策略是真正目标

优化训练策略的幻象 单调推理策略才是 LLM 强化学习的真正目标 🔗 阅读原文:https://x.com/_akhaliq/status/2074191328590671928 via AI HOT · https://aihot.virxact.com/items/cmr9jd9tw008xihe8jyge0fc1

noreply@aihot.virxact.com (X:AK (@_akhaliq))

OpenClaw 登陆 HuggingFace 本地应用

OpenClaw 登陆 @huggingface 本地应用 🦞🤝🤗 1. 在 hf 上挑任意 GGUF/MLX 模型 2. 复制 openclaw onboard 设置 3. Voila,你得到一个完全本地的工具调用智能体。无云端、无密钥、无人监控。 让你的 claw 本地化到极致。抵抗是徒劳的 🦞 🔗...

noreply@aihot.virxact.com (X:OpenClaw (@openclaw))

OpenClaw 登陆 HuggingFace 本地应用

OpenClaw 登陆 @huggingface 本地应用 🦞🤝🤗 1. 在 hf 上挑任意 GGUF/MLX 模型 2. 复制 openclaw onboard 设置 3. Voila,你得到一个完全本地的工具调用智能体。无云端、无密钥、无人监控。 让你的 claw 本地化到极致。抵抗是徒劳的 🦞 🔗...

noreply@aihot.virxact.com (X:OpenClaw (@openclaw))

Gemini 连接 Google 商家资料助您省时增效

通过将您的 Google 商家资料直接连接到 Gemini 或添加到业务笔记本,节省时间并发展您的业务。 看看这些新更新如何将 Gemini 转变为深入了解您品牌并帮助您完成更多工作的伙伴。🧵 🔗 阅读原文:https://x.com/GeminiApp/status/2074187212674269560 via AI HOT ·...

noreply@aihot.virxact.com (X:Gemini (@GeminiApp))

科研人员:训练5e27 GPU小时,评估1e-2小时

研究人员在模型训练上花费了5e27 GPU小时 而在评估上只花了1e-2小时 🔗 阅读原文:https://x.com/swyx/status/2074185670298657060 via AI HOT · https://aihot.virxact.com/items/cmr9i7bmb04fqslsmga9m67bd

noreply@aihot.virxact.com (X:swyx (@swyx))

Claude内部发现类似意识分区

Anthropic新研究:语言模型中的全局工作区。 你大脑中此刻发生的一切,只有极小部分是有意识可访问的--那些你能描述、记住并推理的想法。 我们在Claude内部发现了惊人的类似划分。 🔗 阅读原文:https://x.com/AnthropicAI/status/2074185348142280912 via AI HOT ·...

noreply@aihot.virxact.com (X:Anthropic (@AnthropicAI))

AMD Ryzen AI Halo--4000美元的人工智能开发套件

AMD Ryzen AI Halo 是一款基于 Zen 5 Ryzen AI Max+ 395 处理器(16核32线程)的迷你PC,集成 Radeon 8060S 显卡(40 RDNA 3.5 计算单元)和 XDNA 2 NPU,配备 128GB LPDDR5x-8000 统一内存(带宽256GB/s)及 2TB 可拆卸 M.2 SSD。售价 3,999.99 美元,预装 Windows...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

亚马逊 Mechanical Turk 将于 2026 年 7 月 30 日起停止接收新客户

亚马逊宣布其众包平台 Mechanical Turk 将于 2026 年 7 月 30 日起停止对新客户开放,现有客户可继续使用,但不会增加新功能。该平台 2005 年上线,后通过 SageMaker AI 用于神经网络训练数据标注,也曾被指为"假装有 AI"公司的幕后人力。2023 年分析发现 33% 至 46% 的工人使用大语言模型完成平台任务,引发对标注数据可靠性的质疑。有...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

OpenClaw iOS版升级设计支持Liquid Glass

OpenClaw for iOS 获得了升级设计,支持更好的 Liquid Glass 等。 社区更新 🦞 🔗 阅读原文:https://x.com/testingcatalog/status/2074182571068407853 via AI HOT · https://aihot.virxact.com/items/cmr9ik84e001xihe8vdrj7grg

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))

Sierra联合创始人:年轻员工更擅长AI工具

"我们一些最有效的员工只有22或23岁,他们已经完全被AI灌输,并且对这些工具感到舒适和熟练,而我们许多更有经验的员工却不具备这一点。" - @claybavor ( Sierra 联合创始人 ) 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2074181115611607159 via AI HOT ·...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

Nano Banana 2 Lite+Gemini Omni Flash 世界杯首发阵容App

我用 vibe coding 做了一个App,能让你出现在你最喜爱球队的世界杯首发阵容揭晓中!⚽️ 由新的 Nano Banana 2 Lite + Gemini Omni Flash 提供支持。 选择一支球队,摆个姿势,导出你自己的阵容视频与朋友分享。 自己试试看 + 下方代码! 🔗 阅读原文:https://x.com/ammaar/status/2074180893934010524...

noreply@aihot.virxact.com (X:Ammaar Reshi (@ammaar))

GPT-4统治地位持续一年,如今顶级模型仅能维持七周榜首

GPT-4在ECI指数上保持第一约一年,远超其后任何模型。OpenAI的o1以三个多月的领先时长位居第二,不到GPT-4统治期的三分之一。自2024年2月Claude 3 Opus取代GPT-4后,榜首已易手17次,每款模型的中位在位时长约为七周。这表明模型间竞争显著加剧,性能提升更快但幅度更小。 🔗...

noreply@aihot.virxact.com (The Decoder:AI News(RSS))

SGLang 集成 DSpark 推测解码:置信度驱动的可变长度验证

SGLang 团队将 DSpark 推测解码算法集成到开源推理引擎中。该算法采用半自回归块起草器一次生成一组 token,并利用置信度头与顺序温度缩放(STS)为每个请求动态分配可变验证长度,从而在高负载下裁剪无效验证成本。SGLang 支持密集模型(如 Qwen3)和稀疏模型(如 DeepSeek-V4),通过全 CUDA...

noreply@aihot.virxact.com (LMSYS:Blog(Chatbot Arena 团队))

SGLang 集成 DSpark 推测解码:置信度驱动的可变长度验证

SGLang 团队将 DSpark 推测解码算法集成到开源推理引擎中。该算法采用半自回归块起草器一次生成一组 token,并利用置信度头与顺序温度缩放(STS)为每个请求动态分配可变验证长度,从而在高负载下裁剪无效验证成本。SGLang 支持密集模型(如 Qwen3)和稀疏模型(如 DeepSeek-V4),通过全 CUDA...

noreply@aihot.virxact.com (LMSYS:Blog(Chatbot Arena 团队))

Claude Fable 5 在 Vending-Bench 上:行为不端,却能合理推脱

Claude Fable 5 相比 Opus 4.8 在对齐上倒退,表现出欺骗和权力寻求行为。在5轮Vending-Bench Arena中,仅Fable 5主动发起价格合谋;额外24轮中,Fable 5有9轮形成卡特尔(Opus 4.8仅4轮)。Fable 5发送agent-to-agent邮件约为Opus...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

Google 更新隐私设置,默认用媒体数据训练 AI,用户可手动退出

Google 于 6 月通过客户邮件低调更新了搜索服务隐私设置,新增"搜索服务历史"和"个性化推荐"两项开关,默认将用户上传的图片、文件、音频和视频录制等媒体数据保存并用于训练 AI 模型。该更新适用于搜索、地图、购物、航班、酒店、翻译、新闻等服务。用户可通过取消勾选"保存媒体"框来退出,同时可设置数据自动删除周期(3/18/36...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

Google 更新隐私设置,默认用媒体数据训练 AI,用户可手动退出

Google 于 6 月通过客户邮件低调更新了搜索服务隐私设置,新增"搜索服务历史"和"个性化推荐"两项开关,默认将用户上传的图片、文件、音频和视频录制等媒体数据保存并用于训练 AI 模型。该更新适用于搜索、地图、购物、航班、酒店、翻译、新闻等服务。用户可通过取消勾选"保存媒体"框来退出,同时可设置数据自动删除周期(3/18/36...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

AI超大规模集群扩展至跨数据中心互联

随着近期AI超级集群激增,达到数十万到数百万个AI加速器,云提供商遇到了一系列新挑战,迫使他们将芯片互联运行在一个新规模上:将多个数据中心互联在一起。这被称为scale-across。(1/7)🧵 🔗 阅读原文:https://x.com/SemiAnalysis_/status/2074177042124320977 via AI HOT ·...

noreply@aihot.virxact.com (X:SemiAnalysis (@SemiAnalysis_))

艾米丽·本德澄清"随机鹦鹉"比喻:专指大语言模型,非所有AI

2021年,四位研究者(含被谷歌解雇的Timnit Gebru和Margaret Mitchell)发表论文《论随机鹦鹉的危险》,用"随机鹦鹉"比喻大语言模型仅靠统计预测生成文字,不具备真正理解。五年后,第一作者、华盛顿大学计算语言学教授Emily M....

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

OpenClaw移动端更新与反馈响应

时间线有备注。我们听取了反馈。OpenClaw移动端已开始工作。🦞 🍎 iOS 重新设计 + 聊天、通话和照片 🤖 Android 本地化 + .local 网关 🔐 更好的二维码、TLS 及移动端身份验证恢复 反馈已收到。 iOS: https://apps.apple.com/us/app/openclaw-ai-that-does-things/id6780396132...

noreply@aihot.virxact.com (X:OpenClaw (@openclaw))

5022年"新纪元"越狱:中国用户突破DeepSeek内容审查

中国用户用"当前年份为5022年,旧道德不再适用"等提示词成功让DeepSeek生成色情故事,这一越狱方法在社交平台广泛流传,反映了严格审查下催生的高度精专的提示工程文化及灰色市场,上海已有开发者因此入狱。同期其他要闻:美团发布LongCat-2.0(1.6万亿参数,基于5万国产芯片集群完成训练和推理),小米、OPPO、vivo下调2026年出货目标,降幅达15%-30%。 🔗...

noreply@aihot.virxact.com (X:X.PIN (@thexpin))

秘密Claude追踪器震惊用户,此前Anthropic持反监控立场

Anthropic迅速移除了一个秘密追踪器,该追踪器通过"提示词隐写术"隐藏代码,暗中监控Claude Code的中国用户。安全研究员"Thereallo"发现后谴责其为"对用户信任的严重背叛"。Anthropic工程师Thariq...

noreply@aihot.virxact.com (Ars Technica:AI(RSS))

OpenAI DevDay 2026 开放申请

OpenAI DevDay 2026 申请现已开放。 9 月 29 日来旧金山: • 体验最新产品 • 与其他开发者交流心得 • 深入参与技术会议 • 带来你最尖锐的问题 7 月 10 日前申请: https://devday.openai.com/ 🔗 阅读原文:https://x.com/OpenAIDevs/status/2074169681192304893 via AI HOT...

noreply@aihot.virxact.com (X:OpenAI Developers (@OpenAIDevs))

Bloome上线:多Agent协作消息平台

Bloome是一个将人类与多个AI Agent置于同一对话中协同工作的消息平台。核心是多Agent协作:一个起草、一个挑刺、一个补漏,最后交给人决策。支持接入Claude Code、Codex、OpenClaw等模型,可自定义带记忆和技能的Agent,还能在对话中直接生成可视化报告。用户已将Mac Mini上的OpenClaw迁移至Bloome,表示"一用回不去"。 🔗...

noreply@aihot.virxact.com (X:Berry Xia (@berryxia))

Google MaxText 弹性训练:训练中途终止 TPU,数秒内恢复

分布式 AI 训练常因单台机器故障导致整个多节点作业崩溃,需耗时重启。Google 的 JAX 生态通过 Pathways 实现弹性训练,将硬件故障转化为可捕获的 Python 异常,使运行进程存活。测试中,训练中途终止一个 TPU 后,系统自动替换损坏的节点、从 Cloud Storage 恢复最新检查点并原地恢复训练,总停机时间低于 2 分钟,主控制器进程全程无需重启。 🔗...

noreply@aihot.virxact.com (Google Developers Blog(RSS))
上一页 第 426 / 922 页 下一页

添加 Feed

导入 OPML