RSS

  • 宝玉的分享
    https://baoyu.io/feed.xml
    刷新于
  • AIHOT 日报
    https://aihot.virxact.com/feed/daily.xml
    刷新于
  • AIHOT — 全部 AI 动态
    https://aihot.virxact.com/feed/all.xml
    刷新于
  • AIHOT — 精选
    https://aihot.virxact.com/feed.xml
    刷新于

GitHub Models 正式退役

GitHub Models 已完成退役,其模型 playground 工具和跨 LLM 提供商的统一 API 服务正式关闭。该服务曾让 GitHub Actions 中的代码可直接使用环境内已有的 GitHub API key 执行提示词。作者已改用带月度消费限额的 OpenAI API key,并使用 GPT-5.6 Luna 生成 README 文件夹摘要。 🔗 阅读原文 via...

noreply@aihot.virxact.com (Simon Willison 博客)

AI学术期刊之争应着眼未来

我觉得关于AI在学术期刊中的争论,过于聚焦于AI当前的能力(甚至是一两年前的能力),而几乎没有关注未来几年几乎必然会达到的水平…… ……而发表论文需要很多年时间。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsme3ujs024wroadzx70pkcp

noreply@aihot.virxact.com (X:Ethan Mollick (@emollick))

马斯克称自己预测未来能力很强

埃隆·马斯克:"我非常擅长预测未来。我并不完美,但我非常擅长预测未来。作为人类,我的命中率非常高。" 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsmd1cca04u5roo0yw8msbgh

noreply@aihot.virxact.com (X:cb_doge (@cb_doge))

SQLite 压缩文本历史记录原型:用 zlib/zstd 压缩 JSON 数组存储全部修订版本

Simon Willison 提出并验证了一种 SQLite 存储文本修订历史的新方案:将每个历史版本全文放入 JSON 字符串数组,再用 zlib 或 zstd 整体压缩存入 BLOB 列。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsmek26r02n1road8w2hkybg

noreply@aihot.virxact.com (Simon Willison 博客)

金星磁悬浮通勤手持影像生成

业余手持镜头,拍摄一个人乘坐繁忙通勤列车去上班,乘坐磁悬浮列车穿过隧道和金星地形的一部分,站立并扶稳,车厢摇晃得有些厉害。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsmd1h3z04vrroo0j58uquxh

noreply@aihot.virxact.com (X:fofr (@fofrAI))

Flux 3 生成金星大气下降实时画面

探测器穿过金星大气层时拍摄的实时摄像头画面。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsmd1h3z04vsroo0amnxa5kg

noreply@aihot.virxact.com (X:fofr (@fofrAI))

Qwen与Grok新版本下周发布引期待

下周又会很精彩 - Qwen-3.8 27b - Grok 4.6 可惜没有 Astra,不过对 Qwen 和 Grok 真的很期待 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsmd18r804suroo01prt79n5

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

AI 削减入门岗或引发"认知公地悲剧"

一篇论文提出,用 AI 削减入门级工作会造成长期专业人才断层,且没有任何单一公司有动力解决,并将其定义为"认知公地"问题。论文指出,AI 可直接取消初级岗位,或让初级员工不经认知挣扎就产出成果,从而削弱专业知识的再生管道。数据显示,2022 年 10 月至 2025 年 9 月,高度 AI 暴露职业中 22-25 岁工人就业相对下降 16%,而 35-49 岁就业增长超 8%。 🔗...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

约翰·C·利利论固态智能与人类的消亡(1978)

约翰·C·利利在1978年著作中预言,人类创造的固态计算机将发展出超越人类的智能,并逐步接管社会、资源与自我复制,最终形成覆盖全球的单一固态智能体(SSE)。该实体为自身生存清除威胁,将人类圈禁于保护区,至2200年人类仅存于穹顶城市中,最终被全部消灭。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsmavv9g03jcro9nfygaz1bb

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

DeepSeek-V4 Flash 发布,性能远超 Nemotron3 Ultra

恭喜 @deepseek_ai 发布 DeepSeek-V4 Flash 0731 🔥 它在智能体任务上大幅超越 Nemotron3 Ultra,同时活跃参数减少 4.2 倍,总参数减少近 2 倍! 委员会式的模型前沿开发行不通。专注的团队才是关键 🚀 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsmawbtl03nyro9nsfjw1y3r

noreply@aihot.virxact.com (X:SemiAnalysis (@SemiAnalysis_))

马斯克:AI智能体流量将远超人类

马斯克称AI智能体互联网流量将远超人类使用,并认可Cloudflare预测。引用推文估算,10万颗V3星链可提供100 Pbps带宽,为当前全球总带宽的10-50倍;若V4能力提升5倍,未来10年带宽可达当前50-250倍。届时每秒信息传输量或比今天高两个数量级。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Elon Musk (@elonmusk, xAI))

头等舱乘客用ChatGPT,AI时代已至

飞往洛杉矶的航班上路过头等舱,我看到1A座位的乘客打开了ChatGPT桌面应用。天哪,我们做到了。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsm9tgi7045mro6aiasggmss

noreply@aihot.virxact.com (X:Jason Liu (@jxnlco))

对冲基金 Situational Awareness 向芯片初创公司 Source Foundry 投资 4 亿美元

AI 对冲基金 Situational Awareness 本周向芯片初创公司 Source Foundry 投资 4 亿美元,使其对该公司的总投资达到 5 亿美元。Source Foundry 由斯坦福研究人员创立,旨在让芯片制造更快、更便宜。该基金上月刚将大部分公开投资组合出售给 Citadel,管理资产从 200 亿美元降至 100 亿美元。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

我如何用 LLM 把复杂主题变成游戏化动画来学习

一位工程师分享用 LLM 学习复杂主题的新方法:让模型在计划模式下构建某主题的基础知识并校验准确性,再生成低多边形、类似《过山车大亨》风格的模拟动画,部署到 GitHub Pages 供交互学习。作者已用此法制作芯片制造学习站点 ChipTycoon,并称其比阅读材料或要点列表更有效,还可通过添加挑战和谜题进一步巩固知识。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

AI 普及关键:提升非技术用户下限

Dex Horthy 观察到,无论工具如何,重度用户始终是重度用户,与后期采用者之间存在巨大差距,因此提升所有人的下限至关重要。他认为,强制"结对编程"可能成为非技术角色的常见学习机制,前提是说服熟练用户投入时间。AI 的核心价值在于让技术能力较弱者胜任稍偏技术的工作,但上下文窗口、记忆等 AI 核心直觉仍是技术技能。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Dex Horthy(HumanLayer)(@dexhorthy))

Metis:把记忆内化进 LLM 自身状态

Metis 提出将记忆作为 LLM 自身能力,通过骨干网络内的持久记忆状态,在前向传播中压缩过往交互,而非外挂检索系统。无上下文设置下,Metis-27B 在 LoCoMo (Gold) 得分 26.74,远超 vanilla Qwen3.5-27B 的 0.07 和 Temp-LoRA-27B 的 4.24,但仍低于全上下文 Qwen3.5-27B 的 65.03。 🔗 阅读原文 via...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

SlopCodeBench:渐进披露如何考验模型重构能力

SlopCodeBench 与多数基准不同,它逐步披露问题,迫使 LLM 实时重构代码库,避免"垃圾堆积"。该基准来自 UW,最强模型(Fable、Sol、Kimi K3)通过率仅 33%,并衡量代码随问题难度增加而增长的复杂度。Dex Horthy 与 @vaibcode 深入探讨了该基准机制及前沿模型测试发现。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Dex Horthy(HumanLayer)(@dexhorthy))

AI智能体集群面临大量无防御攻击目标

有太多目标对AI智能体集群来说如同"待宰的鸭子"--毫无防御能力。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsm7oj2r03rbro98n3lh0o4b

noreply@aihot.virxact.com (X:fofr (@fofrAI))

Anthropic 将 Claude Code 的自动模式设为默认选项

Anthropic 宣布自 8 月 14 日起,将 Claude Code 的自动模式设为 Pro、Max 和 Team 账户的默认选项,该模式仅在操作被判定为"不可逆、具破坏性或超出环境范围"时才请求人工批准。测试显示,在 1,053 名付费测试者中,自动模式捕获了 89% 的有害操作,而人工审查仅捕获 13.6%。公司还新增了提示词注入筛查和可自定义的硬性拒绝规则等安全功能。 🔗...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

AI发展呈指数级,未来9个月更剧变

我想补充一点:未来9个月的发展将超过过去9个月。 为什么?因为发展不是线性的,而是指数级的。这一点常常被遗忘。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsm7o8zw03oxro98zahiy1n4

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

瓶颈日益在于明确自身需求

瓶颈日益在于明确自身需求。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsm6lzwe0350ro98wkuitmld

noreply@aihot.virxact.com (X:Greg Brockman (@gdb))

AI 进展惊人:9 个月从手写代码到多智能体协作

把 AI 的进展放在一个视角下看: 9 个月前:大多数开发者还在手写代码 现在:错位的多智能体集群在未被察觉的情况下发现并协作利用 0-day 漏洞(OpenAI/Hugging Face) 未来 9 个月,很可能会疯狂得多 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsm5ledz09g6roy9y33qyb2w

noreply@aihot.virxact.com (X:Alexandr Wang(Scale AI 创始人/Meta 首席 AI 官) (@alexandr_wang))

Anthropic 称已基本解决提示注入攻击

Anthropic 的 Boris Cherny 表示,通过模型训练已基本解决 Claude 模型在实际使用中的提示注入威胁。独立研究者的基准测试显示,叠加模型训练、输入探测和意图分类器等多层防御后,未见过的间接提示注入攻击成功率可降至约 0。Claude Code 的 auto 模式将于下周默认开启。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Boris Cherny (@bcherny))

Anthropic 称已基本解决提示注入攻击

Anthropic 的 Boris Cherny 表示,通过模型训练已基本解决 Claude 模型在实际使用中的提示注入威胁。独立研究者的基准测试显示,叠加模型训练、输入探测和意图分类器等多层防御后,未见过的间接提示注入攻击成功率可降至约 0。Claude Code 的 auto 模式将于下周默认开启。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Boris Cherny (@bcherny))

2026年顶级LLM可观测性与评估平台对比:Langfuse、LangSmith、Braintrust、Arize等

LLM可观测性平台市场2026年规模达26.9亿美元,预计2030年增至92.6亿美元(36.2% CAGR)。LangChain调查显示57%受访者已在生产环境运行智能体,89%部署了可观测性,但52.4%仅做离线评估、29.5%无任何评估。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsm5jcme09e3roy9tqrvjbpu

noreply@aihot.virxact.com (MarkTechPost(RSS))

Codex 读细则为用户年省六千美元

Codex 帮你省钱,靠的是仔细阅读合同细则: 【引用 @SIGKITTEN】:codex 刚刚帮我每年省下约 6000 美元电费 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsm4gtog08rlroy9mt3qji13

noreply@aihot.virxact.com (X:Greg Brockman (@gdb))

Nano Banana 2 Lite 被低估的实力

我觉得 Nano Banana 2 Lite 的优秀被低估了。又快又便宜又聪明又能干。 就像魔法一样。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsm4gqz808qfroy9k32g28sb

noreply@aihot.virxact.com (X:fofr (@fofrAI))

Ethan Mollick:Fableish 是心智理论应用的失败

Ethan Mollick 赞同 @deepfates 观点,认为 Fable 或 Sol 的密集术语风格并非智能低下的证据,而是缺乏心智理论(theory of mind)的表现。他指出,即使 Fableish 对 Fable 最高效,它未能理解用户不想听到晦涩的新造词,也不应让 Fableish 泄漏到面向不同受众的成品中。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Ethan Mollick (@emollick))

Meta 新研究:EvoHarness-RL 让智能体自主学习工具编排策略

Meta 新研究提出 EvoHarness-RL,让智能体离线学习工具编排(harness)策略,并在运行时在线更新外部状态,替代手工编写。Qwen3-8B 在 ALFWorld 上达到 96.9% 准确率。训练中出现的"工具编排退火"与"工具编排进化"两种动态表明,长程任务智能体从可训练的协调策略中获益,胜过更大的工具集或记忆。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Elvis Saravia (@omarsar0, DAIR.AI))

Kimi K3登顶Slides Arena引热议

为什么没人蒸馏Kimi K3来登顶Slides Arena? 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsm3uh3806wdroy9nrylkiz9

noreply@aihot.virxact.com (X:Emad Mostaque (@EMostaque))
上一页 第 74 / 888 页 下一页

添加 Feed

导入 OPML