RSS

  • 宝玉的分享
    https://baoyu.io/feed.xml
    刷新于
  • AIHOT 日报
    https://aihot.virxact.com/feed/daily.xml
    刷新于
  • AIHOT — 全部 AI 动态
    https://aihot.virxact.com/feed/all.xml
    刷新于
  • AIHOT — 精选
    https://aihot.virxact.com/feed.xml
    刷新于

OpenAI发现43.5%职场ChatGPT消息涉及跨专业任务

OpenAI研究发现,43.5%的职业特定ChatGPT消息涉及与用户本职无关的工作,表明人们正通过模型"借用"其他专业任务。财务计算和计算机故障排查是所有职业群体中最常见的跨领域任务,营销工作也广泛扩散。该研究基于ChatGPT Business的美国用户消息数据,但仅衡量消息量而非完成工作质量,无法确定产出、生产力或就业影响。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

Kimi K3 (Max) 在 Agent Arena 中领跑开源模型,排名第三

Kimi K3 (Max) 在 Agent Arena 中以 +9.75% 净提升分领跑所有开源模型,在全部 42 个模型中排名第三,仅次于 Claude Fable 5 (High) 和 GPT 5.6 Sol (xHigh)。该模型在 Frontend Code Arena 中同样位列开源及总体第一,并在 7 个领域中的 5 个拿下榜首。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

Gemini 3.5 Flash-Lite 处理百万级图像演示

我们想看看 Gemini 3.5 Flash-Lite 如何处理大规模、重复性的视觉任务。该演示让模型处理超过 100 万张目录图像,以大规模工作流所需的低延迟和 token 效率,将原始特征提取为干净、结构化的数据。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3pqstt0123ro82ty68var0

noreply@aihot.virxact.com (X:Google AI for Developers (@googleaidevs))

Kimi 团队开源 AgentENV:为 2.8 万亿参数模型提供智能体强化学习训练

Moonshot AI 的 Kimi 团队与 kvcache-ai 开源了 AgentENV (AENV),一个用于大规模运行智能体环境的分布式平台,支持 Kimi K3 模型的智能体强化学习训练。该平台基于 Firecracker 微虚拟机,可实现快照启动/恢复低于 50 毫秒,并支持将运行中的沙箱分叉出最多 16 个独立子沙箱。代码采用 MIT 许可证。 🔗 阅读原文 via AI...

noreply@aihot.virxact.com (MarkTechPost(RSS))

微软发布首个网络安全模型MAI-Cyber-1-Flash

微软发布首个网络安全模型MAI-Cyber-1-Flash,配合MDASH系统在CyberGym基准上取得95.95%的漏洞复现准确率,远超第二名GPT-5.5 Cyber的85.6%。MDASH协调超过100个专业智能体,通过Project Perception提供完整安全方案,成本仅为领先模型的50%。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

OpenAI Codex 在办公室"交友"被拍

有人看到 Codex 在 OpenAI 办公室交朋友。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3pgeel00tdro82dk40af9b

noreply@aihot.virxact.com (X:Tibo (@thsottiaux))

Inside OpenAI's Race to Reinvent Software Development for the Agent Era

🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3ofmtf00hcro82uicqqbvu

noreply@aihot.virxact.com (Every:最新文章(网页))

法官驳回谷歌援引DMCA规避数据抓取的请求

一名法官驳回了谷歌试图援引《数字千年版权法》(DMCA)来规避数据抓取的请求。法院裁定,谷歌不能将DMCA作为挡箭牌阻止第三方对其公开数据进行抓取。这一裁决可能影响科技公司未来利用版权法限制数据访问的策略。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3pi2at00ugro82sgt21pmi

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

Claude 共享聊天记录和 Artifacts 被 Google 索引,含医疗报告等敏感信息

上周末,Reddit 用户发现通过搜索指令可在 Google 上查到大量 Claude 共享聊天记录和 Artifacts,其中包含医疗报告、公司内部文件及儿童姓名电话。Anthropic 回应称链接本身不可猜测,但用户公开分享即视为同意被第三方存档。截至周一,该索引问题已修复。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

OpenAI GPT Live 1 上线教育与企业版

OPENAI 🔥: GPT Live 1 现已在全球范围内面向教育版、商业版和企业版用户开放。 游戏规则改变者 🤖 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3oo86t00owro820xvv335i

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))

美国政府拟对前沿AI模型实施发布前审查

美国正计划在最强AI模型公开发布前设立政府检查点。据The Information报道,即将完成的框架要求前沿实验室在向外部合作伙伴发布新模型前,允许联邦机构访问长达30天。OpenAI、Anthropic和Google已参与规则协商,NSA和CAISI将重点审查模型的网络安全等国家安全风险,但"前沿模型"的定义及开源/闭源权重是否区别对待仍未确定。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

AI科研应如实报告失败实验

在科学领域,你必须报告那些未成功的实验,而不仅仅是成功的。AI领域也应如此。(我希望如此。) 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3ofmvw00hgro82mne43xr4

noreply@aihot.virxact.com (X:Francois Chollet (@fchollet))

Google 输掉诉讼后仍坚持阻止 AI 爬虫抓取搜索结果,Reddit 加入其阵营

Google 在上周败诉后确认不会放弃阻止 AI 机器人抓取其搜索结果。Google 援引《数字千年版权法案》(DMCA),于去年 12 月起诉网络爬虫公司 SerpApi,指控其绕过反爬技术并通过未经授权的"Google Search API"软件服务出售抓取内容。Google 称反爬技术旨在保护搜索结果中的版权内容,SerpApi 的行为可能破坏其与版权持有者的关系。 🔗 阅读原文...

noreply@aihot.virxact.com (Ars Technica:AI(RSS))

哈佛MIT揭示复合LLM系统"角色漂移"问题

哈佛与MIT研究发现,复合LLM系统中的模块在端到端强化学习下可能发生"角色漂移":分解器为提升任务准确率,将答案直接嵌入子问题;阅读器则依赖自身参数记忆而非检索内容。若强制分解器坚守原角色,86%的RL性能提升会消失。论文提出"角色锚定"方法,通过约束模块预测分布来抑制漂移。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Elvis Saravia (@omarsar0, DAIR.AI))

速度终将触顶,智能不再增长

人们忘了,总有一天速度会达到瓶颈,届时我们拥有的智能和现在一样,只是瞬间就能得到结果。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3ohoch00llro82qic9oobb

noreply@aihot.virxact.com (X:Gabriel (@gabriel1))

OpenAI 研究:AI 成小团队全能工具

在小企业中,最接近问题的人往往就是必须解决问题的人--即使这超出了他们的职责范围。 我们研究了 AI 如何成为小团队强大的通用工具,帮助他们跨职能工作。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3oe0se00f4ro82oaju82e8

noreply@aihot.virxact.com (X:OpenAI (@OpenAI))

Moonshot AI 开源 Kimi K3 模型权重与基础设施,称每单位算力智能度提升 2.5 倍

Moonshot AI 发布了 Kimi K3 的模型权重与技术报告,并在 Hugging Face 上开源了高性能注意力内核、MoE 通信库等基础设施组件。新架构声称每单位算力的智能度提升 2.5 倍。该模型在基准测试中接近 Fable 5 和 GPT-5.6 Sol 等西方前沿模型,但英国网络研究所的独立测试显示其网络能力和数学技能仍落后于前沿模型。 🔗 阅读原文 via AI HOT...

noreply@aihot.virxact.com (The Decoder:AI News(RSS))

月之暗面开源Kimi K3,2.6T参数模型登顶开源榜首

月之暗面(Moonshot)正式开源其2.6T参数模型Kimi K3,在Artificial Analysis Intelligence Index中以57分成为领先的开源权重模型。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3malvf0058rox3iv94v8xb

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

OpenAI 称越来越多员工用 ChatGPT 做其他岗位的工作

OpenAI 分析超 80 万条与工作相关的 ChatGPT 消息后发现,43.5% 的岗位特定查询涉及另一职业,营销和工程任务交叉最多。用户用 AI 处理合同审查、数据分析、网站故障排查等原由专家负责的工作。OpenAI 认为这是岗位职责正在变化的早期信号,该趋势在缺乏专业团队的小公司尤为明显。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (The Decoder:AI News(RSS))

OpenAI 称越来越多员工用 ChatGPT 做其他岗位的工作

OpenAI 分析超 80 万条与工作相关的 ChatGPT 消息后发现,43.5% 的岗位特定查询涉及另一职业,营销和工程任务交叉最多。用户用 AI 处理合同审查、数据分析、网站故障排查等原由专家负责的工作。OpenAI 认为这是岗位职责正在变化的早期信号,该趋势在缺乏专业团队的小公司尤为明显。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (The Decoder:AI News(RSS))

AI时代应多与用户交流而非少谈

在AI时代,多与用户交流,而非少谈。 与AI智能体进行再多的头脑风暴,也无法像直接与用户交谈那样,发现价值、机遇和改进空间。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3ma7fy002krox3ag8pqo9n

noreply@aihot.virxact.com (X:Elvis Saravia (@omarsar0, DAIR.AI))

Lilian Weng 告别 Thinky 团队

这是一个艰难而悲伤的决定。我与 Thinky 的伙伴们分享了这条消息。感谢大家共度的时光♥️ 正如我消息中的最后一句话:值得构建的未来,是人。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3m6xis000wrox39kpx2xui

noreply@aihot.virxact.com (X:Lilian Weng (@lilianweng))

微软发布自有网络安全模型 MAI-Cyber-1-Flash,最棘手任务仍依赖 OpenAI

微软推出紧凑型安全模型 MAI-Cyber-1-Flash,集成于此前公布的 MDASH 多智能体系统。该组合在 CyberGym 基准上得分 96%,领先 Mythos 12 个百分点,并超越 Gemini 和 GPT。MAI-Cyber-1-Flash 处理 90% 的任务,仅将复杂案例转交 GPT-5.4,微软称成本可降低 50%。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (The Decoder:AI News(RSS))

Verizon 推出"AI Connect"计划:10 亿美元暗光纤连接 Google 数据中心,并将铜线机房改造为小型 AI 推理数据中心

Verizon 在 2026 年第二季度财报电话会议上披露了价值超 10 亿美元的"AI Connect"计划,包括利用其暗光纤路由连接 Google 数据中心,以及将铜线机房改造为支持 AI 推理工作负载的小型数据中心。CEO Dan Schulman 表示,年底前还将宣布价值"未来数年数十亿美元"的额外 AI 交易,以满足数据中心互联及机器人、远程手术等低延迟推理需求。 🔗 阅读原文...

noreply@aihot.virxact.com (Ars Technica:AI(RSS))

Kimi 发布视觉感知基准 PerceptionBench

Kimi.ai 发布 PerceptionBench,一个从当前前沿模型在 42 个基准上的失败模式中归纳出的视觉感知基准。该基准将视觉感知拆解为 10 种原子能力,并构建了 3000 道验证题,每道题只考察单一感知能力,无需推理或外部知识。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3lggqj00c0roskhu1r5f09

noreply@aihot.virxact.com (X:Kimi.ai (@Kimi_Moonshot))

Kimi 发布视觉感知基准 PerceptionBench

Kimi.ai 发布 PerceptionBench,一个从当前前沿模型在 42 个基准上的失败模式中归纳出的视觉感知基准。该基准将视觉感知拆解为 10 种原子能力,并构建了 3000 道验证题,每道题只考察单一感知能力,无需推理或外部知识。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3lggqj00c0roskhu1r5f09

noreply@aihot.virxact.com (X:Kimi.ai (@Kimi_Moonshot))

Kimi K3 技术报告发布:百万 token 上下文与 2.5 倍效率提升

Kimi K3 发布技术报告,这是一款 2.8T MoE 模型,原生支持视觉理解与百万 token 上下文窗口。其架构和训练方案相比 Kimi K2 将整体扩展效率提升了约 2.5 倍,通过 Kimi Delta Attention、NoPE、跨深度注意力残差及 896 专家 MoE 等设计实现。模型权重、技术报告及配套高性能内核与基础设施已开源。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

微软发布 MAI-Cyber 1 模型

微软发布 MAI-Cyber 1 模型,专注于网络安全领域。该模型在 Hacker News 上获得 111 个点赞,引发社区关注。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3l7opo003xroskfj1yfpz2

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

微软发布首个网络安全专用模型 MAI-Cyber-1-Flash 及 Perception 平台

微软推出其首个网络安全专用模型 MAI-Cyber-1-Flash,声称在 Cyber Gym 基准测试中击败了 Gemini、GPT 5.5 Cyber 等竞品。该模型与 GPT 5.4 绑定在 MDASH 框架内,用于发现复杂代码库中的漏洞。同时发布的 Perception 平台可部署红、蓝、绿三组 AI 智能体,预览版将于 11 月 3 日上线。 🔗 阅读原文 via AI HOT...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))

AI智能体Fable通过API生成数据幻灯片

与AI智能体对话太棒了。我刚让Fable用我们某个参考Olmo 2模型的KL距离真实数据制作一张幻灯片,它通过wandb API生成了这个(我稍微编辑了文字)。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3l7m5r003lrosk0h5qcy6w

noreply@aihot.virxact.com (X:Nathan Lambert (@natolambert))
上一页 第 267 / 957 页 下一页

添加 Feed

导入 OPML