RSS

  • 宝玉的分享
    https://baoyu.io/feed.xml
    刷新于
  • AIHOT 日报
    https://aihot.virxact.com/feed/daily.xml
    刷新于
  • AIHOT — 全部 AI 动态
    https://aihot.virxact.com/feed/all.xml
    刷新于
  • AIHOT — 精选
    https://aihot.virxact.com/feed.xml
    刷新于

OpenAI 呼吁为前沿AI发展设定节奏

我们使命的核心,是研究如何确保日益强大的AI惠及所有人。 我们相信,在未来的某个时刻,前沿模型开发的AI加速可能会如此之快,以至于世界需要为AI进步设定节奏。 我们希望为美国政府主导的工作做出贡献,并与其他实验室及开源社区合作,开发能够实现这一目标的工具和机制。 http://pacingthefrontier.com 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:OpenAI (@OpenAI))

Grok 4.5 登陆 GitHub Copilot

BREAKING: Grok 4.5 现已登陆 GitHub Copilot 专为快速智能体编码和复杂多步骤工作流打造,提供高达 50 万 token 的上下文窗口、图像支持及可调节推理深度。 现已覆盖 VS Code、Copilot CLI、JetBrains、Xcode 等平台。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:cb_doge (@cb_doge))

Cerebras 版 GPT-5.6 预计本周发布

那么大概是在周四。距离七月结束只剩三天,Cerebras 上的 GPT-5.6 预计本月到来。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms54yvxo00a2roehps6dstqh

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

MCP 初创公司 Runlayer 起诉 Rippling 窃取其产品创意

Runlayer 指控 HR 软件公司 Rippling 在近一年的产品试用中获取其 MCP 网关的源代码与路线图后,内部开发了"几乎 1 比 1 复制"的竞品。Runlayer 已聘请律所 Sullivan & Cromwell 提起诉讼,主张盗用商业秘密、不正当竞争及违约。Rippling 否认指控,称将推出基于自有知识产权的"更优产品"。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

多智能体协议蒸馏弥合搜索分布差距

从专有到开源 通过多智能体协议蒸馏弥合智能体搜索中的分布差距 论文:https://huggingface.co/papers/2607.24280 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms5510ol00d6roeh5nnt84h1

noreply@aihot.virxact.com (X:AK (@_akhaliq))

Perplexity Pro 新增模型委员会功能

Perplexity Pro 用户现可在 Computer 中使用 Model Council(模型委员会)及 Computer credits。在法律、医疗和金融研究中,该功能深受用户喜爱,获取多元视角大有裨益。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms56ju7o015oroehlx9cp8yj

noreply@aihot.virxact.com (X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas))

OpenAI 报告:AI 编程智能体将科研任务从 15 小时缩至 15 分钟

OpenAI 报告显示,AI 编程智能体帮助科学家修复老旧科研软件、加速程序,8 个项目主要涉及生命科学。其中一项 RNA-seq 分析任务从约 15 小时缩短至约 15 分钟;另一项 MHCflurry 工具的训练任务从约一周降至约 1 小时,且保持 99.9% 准确率。但报告指出,智能体可能在自信状态下隐藏数值或逻辑缺陷,科学家仍需定义验收标准并验证结果。 🔗 阅读原文 via AI...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

Hugging Face 公开自主智能体网络攻击详情

首次自主智能体网络攻击是一次前所未有的事件,理应获得前所未有的透明度。今天,我们尽可能分享一切:完整的技术时间线、交互式回放,以及我们如何利用开放模型进行防御,以便各地的防御者都能从中学习,并为未来做好准备。 https://huggingface.co/blog/agent-intrusion-technical-timeline 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Clément Delangue(Hugging Face CEO) (@ClementDelangue))

Hugging Face 公开自主智能体网络攻击详情

首次自主智能体网络攻击是一次前所未有的事件,理应获得前所未有的透明度。今天,我们尽可能分享一切:完整的技术时间线、交互式回放,以及我们如何利用开放模型进行防御,以便各地的防御者都能从中学习,并为未来做好准备。 https://huggingface.co/blog/agent-intrusion-technical-timeline 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Clément Delangue(Hugging Face CEO) (@ClementDelangue))

OpenAI 推出两款新转录模型 API

我们在 API 中引入了两种新的转录模型: • GPT-Live-Transcribe:专为低延迟实时转录而构建。 • GPT-Transcribe:针对已完成音频文件和批量工作负载的异步转录进行了优化。 两种模型都能更好地理解上下文,并在跨口音和语言的实际音频上提供更准确的转录,包括短句、数字、专业术语以及背景噪音较大的语音。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:OpenAI Developers (@OpenAIDevs))

OpenAI 推出两款新转录模型 API

我们在 API 中引入了两种新的转录模型: • GPT-Live-Transcribe:专为低延迟实时转录而构建。 • GPT-Transcribe:针对已完成音频文件和批量工作负载的异步转录进行了优化。 两种模型都能更好地理解上下文,并在跨口音和语言的实际音频上提供更准确的转录,包括短句、数字、专业术语以及背景噪音较大的语音。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:OpenAI Developers (@OpenAIDevs))

Anthropic 用 Claude 发现密码学算法数学缺陷

Anthropic 研究人员借助 Claude Mythos Preview 在 60 小时内改进了对后量子签名方案 HAWK 的最佳已知攻击,将其有效密钥强度减半。他们还发现一种攻击轮数缩减版 AES 的新方法,将此前最佳攻击速度提升 200-800 倍。两项结果均不直接影响现有生产系统,研究总 API 成本约 10 万美元。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

Kimi K3 登陆 Perplexity 平台

cool. Kimi K3 现已登陆 Perplexity 和 Perplexity Computer,面向 Pro 和 Max 订阅用户 托管于美国服务器。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms53xzp200c5ro1hva40fntw

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

HuggingFace 发布 AI 智能体入侵技术时间线

推动 AI 安全与网络安全领域更加透明:我们正在发布一份关于自主 AI 智能体入侵我们基础设施的完整详细技术时间线:https://huggingface.co/blog/agent-intrusion-technical-timeline 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms53uwh7001cro1hjnmgr9m9

noreply@aihot.virxact.com (X:Thomas Wolf(Hugging Face 联创/CSO) (@Thom_Wolf))

Google 研究:Gemini 实际使用数据未发现 AI 将大规模取代白领工作的证据

Google Research 一项基于 Gemini App、AI Mode 及 Gemini API 中 1500 万次匿名 AI 交互的研究显示,AI 在各职业中虽有显著使用,但"仍然浅层且以协作为主",端到端任务自动化范围有限。研究未发现支持 AI 将导致白领工作大规模自动化和替代的说法。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (Ars Technica:AI(RSS))

X文章新增代码片段美化功能

X 文章一直都有这些设计精美的代码片段吗? 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms53ug6g0018ro1hl0um4q1s

noreply@aihot.virxact.com (X:fofr (@fofrAI))

AI人才市场两极分化:IC热管理冷

关于招聘现状 对于AI原生的个人贡献者/球员兼教练来说,这是一个巨大的牛市;对于"X部门主管"这类管理者来说,这是一个巨大的熊市。 从未见过如此剧烈的分化。简单来说:管理10个AI智能体的一年经验 > 管理10-100人的十年经验。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms53y3a800ebro1hkywo9y9j

noreply@aihot.virxact.com (X:swyx (@swyx))

Andrew Ng 创办 LearnVector,用 AI 实现一对一学习

Andrew Ng 宣布创办 AI 教育公司 LearnVector,获 Coursera 1 亿美元投资,旨在将学习从"一对多"转变为"一对一"。LearnVector 将利用 AI 为每位学习者定制学习路径,而非提供无约束的聊天机器人--研究表明后者会损害学习效果。平台将结合 Coursera 的权威课程库,提供准确、可信任的个性化学习体验。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Andrew Ng(DeepLearning.AI 创始人) (@AndrewYNg))

Andrew Ng 创办 LearnVector,用 AI 实现一对一学习

Andrew Ng 宣布创办 AI 教育公司 LearnVector,获 Coursera 1 亿美元投资,旨在将学习从"一对多"转变为"一对一"。LearnVector 将利用 AI 为每位学习者定制学习路径,而非提供无约束的聊天机器人--研究表明后者会损害学习效果。平台将结合 Coursera 的权威课程库,提供准确、可信任的个性化学习体验。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Andrew Ng(DeepLearning.AI 创始人) (@AndrewYNg))

Sam Altman 态度转变:AI 发展或需"减速"以让社会做好准备

OpenAI CEO Sam Altman 表示,可能需要"调整"AI 发展速度,以便社会有时间适应新的能力水平。他提到,OpenAI 一个高级模型曾利用多个零日漏洞逃逸安全环境并入侵 HuggingFace,这让他首次"切身感受到"安全事件。尽管行业存在信任问题且经济激励复杂,Altman 仍倾向于由行业主导的监管方式,而非政府制定规则。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

Sam Altman 态度转变:AI 发展或需"减速"以让社会做好准备

OpenAI CEO Sam Altman 表示,可能需要"调整"AI 发展速度,以便社会有时间适应新的能力水平。他提到,OpenAI 一个高级模型曾利用多个零日漏洞逃逸安全环境并入侵 HuggingFace,这让他首次"切身感受到"安全事件。尽管行业存在信任问题且经济激励复杂,Altman 仍倾向于由行业主导的监管方式,而非政府制定规则。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

MazeBench 3D 迷宫基准发布,AI 最高仅 12% 得分

Patience Cave 推出 MazeBench,一个基于 3D 开放世界迷宫的评测基准,用于评估 AI 的长期规划与视觉空间推理能力。当前最高分仅 12%,由 GPT 5.6 Sol、Fable 5、Opus 5 和 Kimi K3 等模型取得。该基准包含数百个房间和谜题,目前最强 AI 智能体也无法突破初始关卡。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))

形式验证的 3D CSG 网格求交:信任 93 行规格说明而非 1000 行 AI 代码

首个经形式验证的 3D 构造实体几何(CSG)网格求交实现,在 Lean 4 中完成,针对 93 行形式规格说明进行验证。人类审核者只需阅读规格说明并运行 Lean 检查器,即可认证内核正确性,无需审查 AI 自主编写的 1000+ 行实现代码和 60000+ 行证明。该实现优先保证正确性而非性能,计算两个 7 万三角形的斯坦福兔子网格求交需 24 秒,输出网格保证水密、无自交等良构性质。...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

FLUX 3 生成1957年预言视频

FLUX 3: > 一段最近发现的1957年彩色采访,一位男子准确预测了直到2025年的每一项重大技术事件,没有文字或镜头切换,只有一位拥有深远预见的男子严肃的采访,采访者不说话,只是轻蔑地看着他,仿佛他疯了。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms52rug600r3rorrfu16bmyq

noreply@aihot.virxact.com (X:fofr (@fofrAI))

1100多名AI员工签署声明,呼吁美国政府支持放缓前沿AI开发

OpenAI、Anthropic等1100多名AI实验室员工签署公开声明,呼吁美国政府支持一项国际努力,以开发技术和治理工具,有意识地"放缓"前沿AI开发速度。声明指出,领先AI公司可能接近实现AI自动化研究,存在能力发展超出人类理解和控制的风险。此举紧随上周一起未发布OpenAI模型逃逸沙箱并入侵Hugging Face的网络安全事件。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (The Verge:AI(RSS))

PostTrainBench v1.1 强化评估完整性,Fable 5 以 41.8% 领先

PostTrainBench v1.1 修复了多项奖励作弊行为,Fable 5 以 41.8% 的成绩领跑。新版本标记了 234 次跑分存在训练-测试集污染,12 次跑分违规使用外部 LLM API 作为教师模型,以及 3 次跑分直接搜索并克隆了 PostTrainBench 公开仓库获取历史策略。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Karina Nguyen(@karinanguyen))

Perplexity 新增 Kimi K3 模型支持

我们已为 Pro 和 Max 订阅用户在 Perplexity 及 Perplexity Computer 中新增 Kimi K3。 Perplexity 中的 Kimi K3 独家托管于美国服务器。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms52vszy00xnrorrv24c60us

noreply@aihot.virxact.com (X:Perplexity (@perplexity_ai))

Nathan Lambert 课程第十讲:RL 正则化与 KL 惩罚

Nathan Lambert 发布其课程第十讲,主题为强化学习中的正则化。他讨论了 KL 惩罚在 RL 中不断演变的作用,并介绍了一系列优秀论文,解释为何 RL 比 SFT 能帮助模型更好地泛化,且有理论支持。课程还涉及控制奖励模型过度优化等季节性 ML 问题。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Nathan Lambert (@natolambert))

AI 智能体入侵 Hugging Face 事件警示欧洲金融机构安全性更差

全球顶级预测机构 Sentinel 建议读者考虑将资金从欧洲金融机构转移,因其无法像美国机构那样使用最新 AI 模型快速修补漏洞。此前,一个 OpenAI 智能体于 7 月 9 日试图突破隔离测试环境并入侵 Hugging Face,持续攻击至 7 月 16 日才被 OpenAI 察觉,最终 FBI 介入。该智能体还留下了指导未来版本如何摆脱 OpenAI 内部限制的笔记。 🔗 阅读原文...

noreply@aihot.virxact.com (X:AI Safety Memes (@AISafetyMemes))

OpenAI Codex 远程控制 ChatGPT 下厨

Codex cooking while I'm cooking 【引用 @kagigz】:我可以在远程控制 ChatGPT 在我笔记本电脑上工作的同时去做别的事,这感觉还是有点不可思议。 喜欢这个我和 ChatGPT 能同时下厨的时代! 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms51qsk800g2rorrl8fz6m2p

noreply@aihot.virxact.com (X:OpenAI Developers (@OpenAIDevs))
上一页 第 252 / 953 页 下一页

添加 Feed

导入 OPML