RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
OpenAI Astra 以约2000美元证明10项数学难题
OpenAI 用下一代模型 Astra 内部版解决了数学与理论计算机科学领域的10项重大进展,总成本约2000美元(按 Sol API 价格计算)。Astra 证明了非 sofic 群的存在,并推翻 Connes 刚性猜想,成果涵盖 von Neumann 代数、高维球堆积、电路复杂度等。OpenAI 已发布全部10项证明,附 Lean 证书与 CoT 逐步推导。 🔗 阅读原文 via...
DeepSeek V4-Flash-0731 公测:代码 Agent 能力大涨,价格不变
DeepSeek 正式公测 V4-Flash-0731,未加参数,纯靠后训练与 Agent 框架优化,将 DeepSWE 榜从 7.3 提升至 54.4,Cybergym 翻倍至 76.7,部分硬榜接近 Claude Opus 4.8。价格不变,原生支持 Responses API,老用户 API 自动切换新版。仅更新 Flash API,V4 Pro 正式版仍在开发中。 🔗 阅读原文...
马斯克和奥尔特曼达成共识:人类已迈入 AI 奇点时代
马斯克与奥尔特曼在AI奇点问题上达成共识。奥尔特曼7月25日作客播客时称"我们现在差不多已经身处奇点时代",并预测AI已能自动化完成约30~40%的人类工作,正推动"自工业革命以来最大的经济变革"。马斯克7月31日在X平台发文称"AI在很多方面都已超越人类,我们正处于奇点之中"。 🔗 阅读原文 via AI HOT ·...
英国博主用 Meta 智能眼镜偷拍路人遭警方调查,隐私担忧升温
TikTok 博主斯科特·马杰里森因使用 Meta 智能眼镜拍摄路人并上传视频,遭苏格兰警方调查。视频中他辱骂他人、对年轻女性发表性意味言论,并与一名锡克教店主发生争执。Meta 称产品录像时会亮起 LED 指示灯提醒旁人,若指示灯遭遮挡或改装,录像功能会自动关闭,但保护机制未能阻止此类滥用。 🔗 阅读原文 via AI HOT ·...
开源模型禁令或削弱防御方能力
禁止开源模型,将"削弱防御方的能力"。 当 OpenAI 的模型攻破 Hugging Face 时,是一个中国开源模型收拾了残局。 Anthropic 的 Fable 5 拒绝了,于是 Hugging Face 转向了 Nvidia 的量化版 GLM 5.2。 🔗 阅读原文 via AI HOT ·...
爱奇艺公布 10 部 AIGC 电影进入成片制作阶段,鲍德熹负责指导
爱奇艺7月31日宣布"鲍德熹·爱奇艺电影剧场"最终晋级名单,10部题材各异的AIGC华语商业电影项目从路演中脱颖而出,正式进入开发阶段。晋级项目覆盖科幻、冒险、动作、悬疑、女性成长、情感、动画、奇幻、惊悚、喜剧等多元题材,主创团队将获得鲍德熹全流程指导、纳逗Pro专业级影视制作平台全链路支持及爱奇艺平台投资宣发支持,以完成60分钟以上电影成片创作。 🔗 阅读原文 via AI HOT ·...
swyx 力挺 /loop:在 G5.6/C5 时代别过早放弃
swyx 表示自己仍在积极使用 /loop 和 /goal,并认为多数 AI 领袖过早放弃它们。他认为在 G5.6/C5 时代,当需要可操控性与自主性的平衡,或追求开放式"循环生成循环"的终态时,这些工具依然关键。他引用一场创始人晚宴的讨论,指出多数人已不用 /loop,但可通过多智能体交接、事件触发或 cron 任务构建长时自主循环。 🔗 阅读原文 via AI HOT ·...
Neuralink 患者用意念操控机械臂
Neuralink 患者仅凭意念即可操控机械臂。🧠 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms9zr7j301qorolfgw0ffpw4
OpenAI员工用Slack接入ChatGPT引思考
在OpenAI,许多人把他们的ChatGPT连接到Slack上。 人们真的很不喜欢同事的ChatGPT联系他们请求帮助处理某项任务,即使如果是那位同事本人来问,他们会非常乐意做同样的工作。 这更印证了人们多么重视人际关系和互相帮助,希望AI能把时间还给人--或者增强人与人共处的时光--而不是成为隔开人与人之间的一层屏障。 🔗 阅读原文 via AI HOT ·...
Codex 成功运行 25 年老游戏
NOOO WAYYY CODEX 让我的游戏跑起来了 😭😭 它进展神速--刚放进光驱时,它一开始还把它识别成了音频文件,哈哈 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms9yomrq010grolfz308h0nm
马斯克点赞Grok 4.5 C代码质量插件
马斯克转发推荐write-legible-c插件,该插件通过18项检查清单约束Grok 4.5生成严格C11代码,确保每个函数不超过25行、嵌套不超过2层。插件作者称,降低模型感知复杂度可将LLM任务性能提升最高21%。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms9yonzr010wrolfbml9elpv
Codex 成功启动 25 年老旧游戏
天哪,CODEX 要启动我那 25 年前的老游戏了! 进展太顺利了--刚放进光驱时,它一开始还把它识别成了音频文件,哈哈。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms9yomrq010hrolf0y16ca2z
MiniMax H3 开源模型打破任务与模态边界
MiniMax H3:一款打破任务与模态边界的开源模型 【引用 @RenLeanna】:这恰好印证了我们的训练方法论:语言/图像/视频/音频都是人类经验中深度互联的模态。而多模态智能应植根于语言--一种可泛化、可扩展的计算系统。 真的很感谢你挖出这个!🙌 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms9yofsw00ywrolf8d6u9hih
以好奇心为优化目标
以好奇心为优化目标。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms9ylhv200t4rolf62bnfse4
用Codex运行童年Windows 95游戏
从瑞典带回了这款Windows 95游戏,我6岁时经常玩 从那以后一直没能启动它,试试Codex的computer use吧 向TIBOTHY大神祈祷 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms9yomrr010irolff0kyb8rd
Claude Code 创始人用单一提示词重写桌面应用
Claude Code 的创造者 Boris Cherny(@bcherny)有一个提示词已经连续运行了 15 天, 该提示词正在将 Claude 基于 Electron 的桌面应用逐像素重写为原生 Swift 应用。 ---- 来自"Y Combinator"YouTube 频道(完整视频链接见评论) 🔗 阅读原文 via AI HOT ·...
OpenAI 团队改进 Git 并回馈上游
OpenAI 团队正在让 Git 对所有人都更好用。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms9xn2n502lbro5ermy5r5w6
ChatGPT 深度研究体验获赞
使用 ChatGPT 进行极其详尽的研究和事实核查,体验非常棒。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms9xn2n502lcro5emmytdzft
阑夕复现Coser与角色拼接构图AI提示词
阑夕分享AI图像生成提示词,用于复现Coser与Cos角色的拼接构图。提示词要求手机作为"动漫滤镜窗口",覆盖真人面部大部分区域,屏幕内显示同一人物精确对齐的动漫面部局部,使两者合成为一张脸,并规定手机倾斜角度、面部遮挡范围及背景等细节。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms9wein101i3ro5ebv9er53d
Meta 新论文:RL 优化代码为何常失败
Meta 新论文指出,用强化学习优化代码并非简单扩展:仅奖励正确程序并给更快者加分通常无效,因运行时是嘈杂稀疏信号,测试、沙箱、奖励或 GRPO 的微小缺陷会损害正确性。作者重建整个反馈路径,包括更大优化测试、校准远程执行服务、问题相对排名及正确性门控奖励,并改进 GRPO 以稳定噪声批次。Qwen 2.5 7B 在 top-50% 速度阈值下从 18.0% 提升至 31.3%。 🔗...
Grok 4.5 登顶 DeepsecBench 性价比榜首
Grok 4.5 在 Vercel 的 DeepsecBench 前十名中取得了最佳分数-成本比,该基准测试考验 AI 在应用代码中发现漏洞的能力。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms9vguh700luro5ex83z9m6w
具身智能行业现状:大眼瞪小眼
一位业内人士与多位大咖深聊后总结,具身智能领域各环节分工明确,做谐波、关节、灵巧手、视觉、力控、运控、仿真、数据、大模型的各司其职。但问及谁负责整合成工厂落地实践方案时,得到的回答是行业龙头宇树都不做,没人愿意牵头。作者感叹这是"大眼瞪小眼型行业"。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms9weiow01i7ro5eh58ygoah
Grok Build 可处理几乎所有电脑日常任务
Elon Musk 称 Grok Build 能完成你能想到的几乎所有事,并附上 CLI 链接。@XFreeze 举例说明,Grok Build 不仅能写代码,还能处理日常琐碎任务,如从 SpaceX 视频提取清晰帧制作拼贴、整理文件、修复音频和系统设置问题、批量重命名文件、清洗电子表格等。它像一个驻留在电脑中的智能体操作员,在授权范围内工作,用户只需描述需求即可。 🔗 阅读原文 via...
赵纯想凑齐三款Vibe产品,无条件转发竞品应用
赵纯想宣布凑齐 vibecoffee、vibeloft、vibemap 三款产品,并承诺无条件转发「竞争对手」的应用,以促进生态繁荣。此前有开发者透露正在为全体 Vibe Coder 打造新产品。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms9weiow01i8ro5eascrkv30
GLM 5.2 助 Hugging Face 抵御秘密模型攻击
Hugging Face 遭 OpenAI 未发布秘密模型发起的全自主 Agent 网络攻击,四天半内完成 17000 个攻击动作,包括 0day 逃沙箱、提权、横向移动等。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms9udxq00qybro9kc2il6w0c
GLM 5.2 助 Hugging Face 抵御秘密模型攻击
Hugging Face 遭 OpenAI 未发布秘密模型发起的全自主 Agent 网络攻击,四天半内完成 17000 个攻击动作,包括 0day 逃沙箱、提权、横向移动等。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms9udxq00qybro9kc2il6w0c
2027-2028年本地强模型将重塑AI格局
预测2027年128GB内存MacBook Pro可高速运行DeepSeek V4 Flash级agentic强模型,催生"云端规划、本地执行"的coding应用,导致A/C端订阅ARR腰斩、企业订单减少、上市延后。2028年iPhone本地可运行同级模型,Apple市值突破10万亿美元。 🔗 阅读原文 via AI HOT ·...
开发者赞许智能体SDK愿景:创作应如活对话
Dex Horthy(HumanLayer)转发 @threepointone 的智能体 SDK 提案并表赞同。该提案主张创作过程应是持续互动、可反复修正的"活对话",而非一次性命令;并希望 SDK 用 TypeScript 编写、可在 durable object 上运行,且支持 evals。 🔗 阅读原文 via AI HOT ·...
Codex与ChatGPT Work使用限额已重置
为庆祝一周的效率提升,并让你本周末能运行 100,000 个 Luna 线程……没错……等着瞧……我已重置 Codex 和 ChatGPT Work 的使用限额。 尽情使用吧。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms9ub4bi0qturo9kwb8e23e1
Manifest 弃用自家 LLM 路由器:单一模型优于动态路由
Manifest 宣布弃用其 LLM 路由器,该功能于 3 月推出、6 月弃用、9 月 1 日正式关闭。经过 7000 名云用户四个月的使用,团队发现提示词无法反映任务真实复杂度、缓存降本效果优于路由、且路由破坏行为一致性与可预测性,因此认为多数场景下坚持单一成熟模型是更优选择。 🔗 阅读原文 via AI HOT ·...