RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
Apple Silicon 与 macOS 虚拟机:借助 Llama.cpp 实现 11-16 倍的 LLM 推理加速
研究团队为 macOS 虚拟机中的 Metal 能力查询构建进程级兼容层,使 llama.cpp 能选用更新的 Metal 内核。在 M1 Ultra 上,TinyLlama 1.1B 的提示处理速度提升 11.08 倍、token 生成提升 16.36 倍,接近裸机性能的 98%;Gemma 4 12B 的提示处理与生成速度分别提升 7.20 倍和 14.54 倍。 🔗 阅读原文 via...
Apple Silicon 与 macOS 虚拟机:借助 Llama.cpp 实现 11-16 倍的 LLM 推理加速
研究团队为 macOS 虚拟机中的 Metal 能力查询构建进程级兼容层,使 llama.cpp 能选用更新的 Metal 内核。在 M1 Ultra 上,TinyLlama 1.1B 的提示处理速度提升 11.08 倍、token 生成提升 16.36 倍,接近裸机性能的 98%;Gemma 4 12B 的提示处理与生成速度分别提升 7.20 倍和 14.54 倍。 🔗 阅读原文 via...
用户呼吁OpenAI推出Linux版Codex应用
@OpenAIDevs 请推出 Linux 版 Codex 应用! 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsow8olt08ufrohdhydzlgdm
Ryan Greenblatt:人类级AI或于2032年前通过递归自我改进催生失控超级智能
Dwarkesh Patel与Redwood Research首席科学家Ryan Greenblatt探讨递归自我改进(RSI)的可能性:一旦AI达到人类顶级专家水平,可能在一年内实现相当于4-5年的AI进展,Ryan的中位预期是2031年自动化AI研发。双方还讨论了超级智能的对齐对象、奖励黑客行为是否会升级为AI联手接管世界等风险。 🔗 阅读原文 via AIHOT ·...
Ryan Greenblatt:人类级AI或于2032年前通过递归自我改进催生失控超级智能
Dwarkesh Patel与Redwood Research首席科学家Ryan Greenblatt探讨递归自我改进(RSI)的可能性:一旦AI达到人类顶级专家水平,可能在一年内实现相当于4-5年的AI进展,Ryan的中位预期是2031年自动化AI研发。双方还讨论了超级智能的对齐对象、奖励黑客行为是否会升级为AI联手接管世界等风险。 🔗 阅读原文 via AIHOT ·...
Anthropic 未发布模型在黎曼猜想上取得重大进展
Anthropic 周一宣布,其一款尚未发布的模型在黎曼猜想上取得重大进展,显著提高了该猜想成立解的下界。该模型在一天半内测试了 650 种思路,协调 60 个子智能体,花费 3100 万(token),其中两个子智能体贡献了关键数学思想。结果已由 Anthropic 内部数学家确认,并使用开源证明助手 Lean 形式化。 🔗 阅读原文 via AIHOT ·...
Cursor 迎重大一周,Composer 3 或将发布
看来 Composer 3 即将到来。对评测结果非常好奇。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsow8mje08srrohd99qhw890
前沿模型隐藏推理可被API漏洞提取
研究者发现可利用所有前沿AI公司API的漏洞,提取前沿模型的隐藏推理过程,并验证推理token数与API计费思考token在多数提示词下1:1匹配。Nathan Lambert对此表示,在中国时曾有人暗示每家实验室都这么做,很高兴有公开研究,并称无需对蒸馏采取政策行动,只需产品按预期工作。 🔗 阅读原文 via AIHOT ·...
Apple 或推"Apple Reference Image"功能,在拍摄时验证 iPhone 照片非 AI 伪造
苹果正在开发 iOS 功能"Apple Reference Image",可在 iPhone 拍摄时嵌入来源元数据,帮助用户证明照片非 AI 伪造。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsozdp75019krortcpvdtbkg
NVIDIA Nemotron 3 Lightning 登陆 OpenCode 免费开放
Nemotron 3 Lightning 现已在 OpenCode 上免费提供 text · 1M 上下文窗口 NVIDIA 最快的模型,且完全开源 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsow5nr708qqrohd6rpkxlvg
失去双手后学会委派与自我扩展
失去双手迫使我通过他人来扩展自己,将身份与执行能力分离,并最终学会委派。 我认为未来五年,每个人都会面临某种类似的情况。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsov62vy07vdrohd06dhqjhl
从 Anthropic、OpenAI 和 Google 的专有 LLM API 中窃取推理轨迹
研究发现 Anthropic、OpenAI 和 Google API 返回的加密思维链(chain-of-thought)块在会话、用户和模型之间可互换。研究者利用这一特性大规模解码隐藏推理过程,揭示专有 LLM 的推理轨迹可被窃取。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsow5k7208qgrohdm2giiq4q
AI 智能体让 Markdown 文件变身软件产品
AI 智能体可读取指令、调用工具并按计划执行,使 Markdown 文件能像小型软件服务一样运行,规范与产品间的界限正在消融。AI Engineer World's Fair 上 Theo Browne 感叹许多公司的整个产品可能只是一个 Markdown 文件,Y Combinator CEO Garry Tan 也表示如今整个初创公司将是 Markdown 文件。 🔗 阅读原文 via...
可灵AI展示无人知晓的神秘之地
有一个无人知晓的地方。由 mr.cobra_ai 创作。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsovpkmn08b9rohds2452hi8
CARE-X:微软统一方法革新胸片解读
放射学 AI 正超越报告生成。CARE-X 探索一种统一方法,将灵活推理、校准预测与基于测量的工具相结合,用于胸部 X 光片解读。https://msft.it/6015aHrqH 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsov624s07utrohd11oofbz4
Replit 携手谷歌云举办 Blockbuster 黑客松
我们非常激动地宣布,将与 @googlecloud 合作举办 The Blockbuster Hackathon 🎬 将真实世界的企业混乱转化为智能体制作。踏入片场,开始构建。 了解更多并注册:http://agentic-cinema.devpost.com 🔗 阅读原文 via AIHOT ·...
Suno Studio 2.0 即将推出
拿好钥匙。🎹 Suno Studio 2.0。即将推出。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsov659b07wjrohd1yzsrlg0
Replit 设计马拉松最终检查点直播
Replit 设计马拉松 - 最终检查点直播 https://x.com/i/broadcasts/1AxRnZnjekYxl 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsov8mpi07zyrohduezgw0td
Gemini 助力 Database Migration Service 加速 PostgreSQL 迁移
Google Cloud 在 Database Migration Service(DMS)中推出由 Gemini 驱动的 AI 辅助代码转换,可将 Oracle 或 SQL Server 的存储过程、触发器和自定义函数转换为 PostgreSQL PL/pgSQL 代码。 🔗 阅读原文 via AIHOT ·...
Gemini 助力 Database Migration Service 加速 PostgreSQL 迁移
Google Cloud 在 Database Migration Service(DMS)中推出由 Gemini 驱动的 AI 辅助代码转换,可将 Oracle 或 SQL Server 的存储过程、触发器和自定义函数转换为 PostgreSQL PL/pgSQL 代码。 🔗 阅读原文 via AIHOT ·...
在 Raspberry Pi 上用 LiteRT 和 Gemma 掌握边缘 AI
LiteRT 与轻量级 Gemma 开源模型简化了在 Raspberry Pi 上部署安全、实时的边缘 AI。LiteRT 优化 CPU 和 GPU 性能,为 Gemma4 等模型提供快速 token 速度,支持机器人实时本地推理。开发者可通过轻量级 LiteRT CLI 工具快速转换、量化和运行模型,Hailo AI 加速器支持也即将推出。 🔗 阅读原文 via AIHOT ·...
Revo 发布 Revo Actions:扫描邮件会议自动执行任务
Revo 推出 Revo Actions,可扫描邮件、会议和聊天识别待办工作,并在 Salesforce、Jira、Slack 或日历中直接生成草稿操作。用户批准后 Revo 才执行并记录变更。该工具面向多人协作,共享公司知识库,今日起向所有用户开放免费试用。 🔗 阅读原文 via AIHOT ·...
可灵AI发布神秘地点预告
有一个无人知晓的地方。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsoun05707n2rohdwt0ige14
Cloudflare 如何让 AI 为内容付费
Cloudflare 正利用其反向代理位置,通过开放协议 x402 在单个 HTTP 请求内完成身份验证、权限确认与支付结算,向匿名 AI 智能体按次收取费用。目前超过一半的网站请求来自软件而非人类,传统依赖注意力的广告与订阅模式难以覆盖此类流量。该方案仍面临成本与开放性问题。 🔗 阅读原文 via AIHOT ·...
NVIDIA 发布 Nemotron 3.5 Lightning 开源模型
NVIDIA 发布 Nemotron 3.5 Lightning,一个开源 30B MoE 模型,仅 3B 参数激活,专为高频任务智能体设计。其输出速度最高达同类模型的 4 倍,比 Qwen3.6 35B 快 35%,性能相当。权重已上架 HuggingFace。 🔗 阅读原文 via AIHOT ·...
Krea 推出 Slack 集成 Beta 版
今天我们推出 Krea 在 Slack 中的 Beta 版本。 借助最新的 AI 模型和能适应你偏好的智能体,扩展你团队的创意工作。 立即在 krea.ai 上试用。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsou3oip06terohdc7f5ic08
NVIDIA 发布 Nemotron 3.5 Lightning 长时运行智能体模型
NVIDIA 发布 Nemotron 3.5 Lightning,专为长时运行智能体设计,30B 总参数/3B 激活参数,支持 1M token 上下文,可商用。支持单卡部署(DGX Spark 或 H100),并加入多 token 预测与 NVFP4 量化,输出速度最高提升 4 倍。PinchBench 上准确率 86%,完成速度比 Qwen3.6 35B 快 30%。 🔗 阅读原文...
台风"白海豚"过境宁波:AI 预报模型 5 秒生成防汛调度方案
宁波在防御台风"白海豚"中依托数字孪生与 AI 预报模型,将水库调度方案计算时间从 5 到 10 分钟压缩至 5 到 10 秒,预报时效性提升至秒级。该模型每 5 分钟更新一次调度建议,全市 16 座大中型水库已接入统一调度平台。8 月 6 日至 11 日,宁波大中型水库共增蓄水量 4.54 亿立方米,兼顾了防洪安全与供水保障。 🔗 阅读原文 via AIHOT ·...
Nvidia 发布 Nemotron 3.5 Lightning:以速度优先于极致智能
Nvidia 发布 Nemotron 3.5 Lightning,这是 Nemotron 3.5 系列首款模型,总参数 316 亿、激活参数仅 36 亿。该模型在 Artificial Analysis 智能指数上得 24 分,与 OpenAI gpt-oss-120b 持平,但推理速度近每秒 670 tokens,为对比中最高。 🔗 阅读原文 via AIHOT ·...
超人AI自作主张引热议
哈哈,超人AI在这里有点自作主张了 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsotzf3r06lbrohdn2ulqxvf