RSS

  • 宝玉的分享
    https://baoyu.io/feed.xml
    刷新于
  • AIHOT 日报
    https://aihot.virxact.com/feed/daily.xml
    刷新于
  • AIHOT — 全部 AI 动态
    https://aihot.virxact.com/feed/all.xml
    刷新于
  • AIHOT — 精选
    https://aihot.virxact.com/feed.xml
    刷新于

我们用免费本地模型对 OpenClaw 仓库进行实时分类

Hugging Face 在 OpenClaw 仓库上测试用 Gemma 和 Qwen 等本地模型实时分类 issue 和 PR。他们使用 Pi agent harness 驱动模型,配合 reposhell 只允许读操作防止提示词注入。测试的模型包括 gemma-4-26b-a4b 和 qwen3.6-35b-a3b,经性能优化后均可在本地生成数百 token/s。该方案运行在...

noreply@aihot.virxact.com (Hugging Face:Blog(RSS))

能力强但粗心:计算机使用智能体是否遵循情境完整性?

AgentCIBench评估计算机使用智能体(CUA)是否遵循情境完整性。它针对三种常见失败模式:视觉共置(智能体拉取任务目标旁边被禁止的项目)、任务模糊性过度分享(在提示不明确时泄露个人状态)以及收件人错配(向不适当的收件人发送内容)。对15个前沿CUA的评测显示平均泄漏率67.9%,其中11个在超过50%的场景中泄漏,这些失败在端到端任务中同样存在。AgentCIBench已发布,旨在推...

noreply@aihot.virxact.com (HuggingFace Daily Papers(社区热门论文))

NSA局长:Mythos数小时内攻破其几乎所有机密系统

美国NSA局长称,Mythos在数小时内攻破了其几乎所有机密系统。此前Mythos已在5天内破解MacOS。而顶级漏洞团队Google Project...

noreply@aihot.virxact.com (X:AI Safety Memes (@AISafetyMemes))

美团tabbit国际版免费接入GPT-5.5/Claude Opus 4.8等旗舰模型

美团近期上线tabbit国际版应用,免费集成多家顶级AI模型的最新旗舰版,包括GPT-5.5、Claude Opus 4.8、Gemini 3.5 Flash,以及国内Kimi-2.6、GLM-5.1、MiniMax-M3。用户无需单独订阅即可使用这些模型。需注意:只有国际版包含海外模型,国内版仅提供国内模型。该应用旨在抢占AI入口,目前处于免费推广阶段。 🔗...

noreply@aihot.virxact.com (X:阿易 AI Notes (@AYi_AInotes))

腾讯元宝父亲节活动:上传照片生成与年轻爸爸的合影

腾讯元宝推出父亲节主题活动,用户可选择爸爸年轻时照片与自己的照片,输入提示词(如"帮我生成一张和爸爸的合影,将图2的我融合到图1爸爸的照片中,我想穿越回__年前,和他一起_____;保留爸爸照片的背景、动作及五官;人物姿态自然协调,整体光线与色调保持一致"),元宝即可生成合影。活动旨在让用户"回到过去"看到爸爸的青春模样。 🔗...

noreply@aihot.virxact.com (公众号:腾讯元宝)

AI HOT 日报 · 2026-06-21 — 微软双向转售GPT与DeepSeek成全球最大AI中间商

微软双向转售GPT与DeepSeek成全球最大AI中间商 — 点击查看完整日报

noreply@aihot.virxact.com (AI HOT)

Anthropic IPO或延迟,OpenAI抢跑融资

在这一点上,我很容易看到围绕Anthropic的戏剧性事件会迫使其推迟IPO,而OpenAI则竭尽全力抢先上市并在此过程中筹集更多资金。

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

从PGP到Mythos:出口管制未能阻止任何人的简史

美国白宫以国家安全为由,命令Anthropic限制AI模型Fable 5和Mythos出口,导致两款模型暂停向美国境外用户及境内外国公民提供服务。此前Anthropic仅向约150家受审查企业和政府机构开放Mythos。触发禁令的两个事件:Anthropic向一家被怀疑与中国有关联的韩国电信公司(普遍报道为SK电信)提供Mythos访问权限;亚马逊CEO称其研究人员找到了绕过Fable...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

特斯拉AI工程师:ML训练仅占2%,数据质量定上限

特斯拉AI高级工程师(从事自动驾驶与机器人ML)揭露ML项目真实时间分配:50%评估、40%数据清洗、8%集成、2%训练。前两项共同设定学习的噪声底限,模型无法降低--这是数据的香农最优界。他每天思考本体论(ontology),旧标签必须持续审查,因为生产系统中分布漂移与边缘用例不断暴露标签缺陷。核心结论:训练不是瓶颈,清理现实数据的能力才是关键。

noreply@aihot.virxact.com (X:阿易 AI Notes (@AYi_AInotes))

欧洲零售协会要求欧盟豁免非欺骗性AI广告的"深度伪造"标注义务

欧洲零售协会Eurocommerce(成员包括Amazon、H&M、Inditex、Ikea)致信欧盟科技专员Henna Virkkunen,要求对非欺骗性AI生成广告图像豁免EU AI...

noreply@aihot.virxact.com (The Decoder:AI News(RSS))

AlphaFold 之父 John Jumper 离开 Google DeepMind,加入 Anthropic

诺贝尔化学奖得主、AlphaFold 团队负责人 John Jumper 宣布离开 Google DeepMind,加入 Anthropic(休息一段时间后)。他在 GDM 工作近 9 年,博士毕业仅 6 个月便被 Demis Hassabis 委以重任领导 AlphaFold,实现了蛋白质结构预测突破。此前已有大批 OpenAI 核心研究员流入 Anthropic,Jeff Dean...

noreply@aihot.virxact.com (X:Berry Xia (@berryxia))

Claude Mythos出口管制后约200家美国机构仍保留顶级AI访问权限

美国对Anthropic最强模型Claude Mythos实施出口管制后,仍有约200家早期用户(包括部分银行、Cisco、Dragos等)保留访问权限,普通用户和大多数组织已被挡在门外。据Bloomberg报道,这200家机构手握外界无法触及的顶级AI能力,形成"永久底层阶级"式的AI鸿沟。差距不是简单API购买能力能弥补,普通用户甚至见不到这些模型。

noreply@aihot.virxact.com (X:Berry Xia (@berryxia))

GLM-5.2 与 Fable 5 测评:五十分之一价格实现九成效果,开源模型跨过"够好且便宜"线

同一任务、同一 prompt、同一参考图下,GLM-5.2(价格 <$0.10)效果接近 Fable 5(约 $5)的九成,价格仅为后者五十分之一。作为最强开源模型,GLM-5.2 体积从 1.5TB 压缩 84% 至 238GB,可在 256GB Mac 本地运行,保留 82% 能力。当开源模型跨过"够好且便宜到随便用"的线,设计探索第一步的默认选项可能从 Fable 转向 GLM-5.2。

noreply@aihot.virxact.com (X:阿易 AI Notes (@AYi_AInotes))

GLM-5.2势头猛,开源LLM或胜闭源

Fable 仍未回归(遗憾)。与此同时,GLM-5.2 变得非常出色。 如果 Fable 或 GPT-5.6 因安全风险无法发布,而 Kimi K3 或 GLM-5.3 率先推出,那么开源大语言模型或许有机会击败公开的闭源模型。

noreply@aihot.virxact.com (X:Yuchen Jin (@Yuchenj_UW))

2026年内存短缺下的冯·诺依曼架构

POV:在2026年的大内存短缺期间享受冯·诺依曼架构

noreply@aihot.virxact.com (X:SemiAnalysis (@SemiAnalysis_))

DeepMind内部爆料:实验室陷入焦虑,前沿模型落后至第五位

Google DeepMind内部员工爆料,实验室已陷入严重焦虑与不满。当前DeepMind在Artificial Analysis智能指数仅列第五,落后Anthropic、OpenAI及智谱AI。上一次重大模型更新是4个月前的Gemini 3.5 Flash,实际表现大多未超越2月的Gemini 3.1 Pro。原定6月30日发布的Gemini 3.5...

noreply@aihot.virxact.com (X:Berry Xia (@berryxia))

Codex 实现本地远程线程无缝切换

现在 Codex 能将代码线程从笔记本无缝 handoff 到远程服务器,再随时接回。过程自动打包 Git 状态、未提交变更、分支、工作树等全部上下文,无需手动 sync 或重建环境。该功能消除了本地开发与远程重型计算之间的摩擦,让 agent 自动管理状态流动,用户可根据需要自由切换场景。

noreply@aihot.virxact.com (X:Berry Xia (@berryxia))

诺贝尔奖得主John Jumper离开DeepMind加入竞争对手Anthropic

诺贝尔化学奖得主John Jumper宣布离开Google DeepMind,加入竞争对手Anthropic。他在DeepMind工作近9年,曾领导AlphaFold团队,该团队因蛋白质结构预测模型获2024年诺贝尔奖。据Bloomberg报道,Jumper还参与谷歌编程工具开发。此外,Character AI联合创始人Noam Shazeer本周也离开DeepMind,转而加入OpenAI。

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

Steam Controller 可完成此操作

可以用 Steam Controller 完成此操作。主推文呼吁有人将此事与 codex 联系起来 @Dimillian。

noreply@aihot.virxact.com (X:Jason Liu (@jxnlco))

Kim 发布微软 Build 大会 Vlog

我做了一个微软 Build 大会的 Vlog。来看看吧!:) https://www.youtube.com/watch?v=HxSbcXuPAnI

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

Nathan Lambert为RLHF书建后训练学习社区

我很少宣传的一件事是,我为我的 RLHF 书籍创建了一个 Discord 社区,该书几周后即将印刷出版。 旨在为想要学习后训练的下一代人提供一个学习和交流的社区。

noreply@aihot.virxact.com (X:Nathan Lambert (@natolambert))

研究:AI拉平表现,合同劳动商品化

一些有趣的发现表明,通过拉平表现,AI也将合同劳动商品化。

noreply@aihot.virxact.com (X:Ethan Mollick (@emollick))

开源寓言级模型可运行于基础MacBook

将有一个开源寓言级模型,可在基础MacBook mini / Air或同等设备上运行。 我认为人们还没有意识到这一点。

noreply@aihot.virxact.com (X:Emad Mostaque (@EMostaque))

如今,大型语言模型变得很复杂

2022-2023年Meta的Llama架构还是干净的重复Transformer模块,如今LLM已复杂:多种注意力变体(查询分组、压缩、稀疏、线性、滑动窗口等)、混合专家从FFN扩张到注意力块和残差流、视觉/音频编码器从外挂变为融合、多GPU推理引入通信操作。Seb Raschka的架构图库可对比Llama 3与Nemotron 3...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

AI 特定风格小说再获文学奖 建议引入全字母句检测

Ethan Mollick 指出 AI 在一般小说写作上较弱,但擅长一种特定风格(隐喻丰富、短句、情节轻),这类作品在现代文学短篇小说比赛中可脱颖而出。@nabeelqu 提及又一篇 AI 生成故事赢得文学奖,评委包括小说家 Ruth Ozeki,进而建议文学奖评选流程应加入全字母句检查(Pangram checks)以识别 AI 文本,或修改规则以接纳 AI 写作。

noreply@aihot.virxact.com (X:Ethan Mollick (@emollick))

S-Agent 空间工具使用推理

S-Agent 空间工具使用催生空间智能的推理

noreply@aihot.virxact.com (X:AK (@_akhaliq))

可灵AI预告MV,三天后发布

预告片已出!完整MV三天后发布,敬请期待。🔥

noreply@aihot.virxact.com (X:可灵 Kling AI (@Kling_ai))

GLM 5.2发布三天登榜第六

GLM 5.2 大受欢迎 已发布 3 天,便在我们榜单上排到第 6 名

noreply@aihot.virxact.com (X:opencode (@opencode))

OpenAI 新论文:RL 训练模型"好行为"也会泛化,提升诚实与安全性

OpenAI 针对对齐中的"涌现失调"反向探索:若模型在某领域被强化诚实、认知谦逊、可纠正等特质,好行为是否泛化?他们用 RL 训练模型,仅在健康、教育等部分对话数据中强化这些特质,其余仍用常规数据。结果发现:训练领域内模型更诚实透明;在 44 个未见评测上,欺骗、谄媚、reward hacking、有害建议等全部下降;面对 adversarial prompt...

noreply@aihot.virxact.com (X:Oran Ge (@oran_ge))

Codex + Excalidraw 原生无线画布

这不是直接掀桌子啊! 搞起来啊,有点舒服啊! Codex 与 Excalidraw 结合,实现原生无线画布,无需额外插件。

noreply@aihot.virxact.com (X:Berry Xia (@berryxia))
上一页 第 685 / 1053 页 下一页

添加 Feed

导入 OPML