RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
OpenAI 称越来越多员工用 ChatGPT 做其他岗位的工作
OpenAI 分析超 80 万条与工作相关的 ChatGPT 消息后发现,43.5% 的岗位特定查询涉及另一职业,营销和工程任务交叉最多。用户用 AI 处理合同审查、数据分析、网站故障排查等原由专家负责的工作。OpenAI 认为这是岗位职责正在变化的早期信号,该趋势在缺乏专业团队的小公司尤为明显。 🔗 阅读原文 via AI HOT ·...
AI时代应多与用户交流而非少谈
在AI时代,多与用户交流,而非少谈。 与AI智能体进行再多的头脑风暴,也无法像直接与用户交谈那样,发现价值、机遇和改进空间。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3ma7fy002krox3ag8pqo9n
Lilian Weng 告别 Thinky 团队
这是一个艰难而悲伤的决定。我与 Thinky 的伙伴们分享了这条消息。感谢大家共度的时光♥️ 正如我消息中的最后一句话:值得构建的未来,是人。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3m6xis000wrox39kpx2xui
微软发布自有网络安全模型 MAI-Cyber-1-Flash,最棘手任务仍依赖 OpenAI
微软推出紧凑型安全模型 MAI-Cyber-1-Flash,集成于此前公布的 MDASH 多智能体系统。该组合在 CyberGym 基准上得分 96%,领先 Mythos 12 个百分点,并超越 Gemini 和 GPT。MAI-Cyber-1-Flash 处理 90% 的任务,仅将复杂案例转交 GPT-5.4,微软称成本可降低 50%。 🔗 阅读原文 via AI HOT ·...
Verizon 推出"AI Connect"计划:10 亿美元暗光纤连接 Google 数据中心,并将铜线机房改造为小型 AI 推理数据中心
Verizon 在 2026 年第二季度财报电话会议上披露了价值超 10 亿美元的"AI Connect"计划,包括利用其暗光纤路由连接 Google 数据中心,以及将铜线机房改造为支持 AI 推理工作负载的小型数据中心。CEO Dan Schulman 表示,年底前还将宣布价值"未来数年数十亿美元"的额外 AI 交易,以满足数据中心互联及机器人、远程手术等低延迟推理需求。 🔗 阅读原文...
Kimi 发布视觉感知基准 PerceptionBench
Kimi.ai 发布 PerceptionBench,一个从当前前沿模型在 42 个基准上的失败模式中归纳出的视觉感知基准。该基准将视觉感知拆解为 10 种原子能力,并构建了 3000 道验证题,每道题只考察单一感知能力,无需推理或外部知识。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3lggqj00c0roskhu1r5f09
Kimi 发布视觉感知基准 PerceptionBench
Kimi.ai 发布 PerceptionBench,一个从当前前沿模型在 42 个基准上的失败模式中归纳出的视觉感知基准。该基准将视觉感知拆解为 10 种原子能力,并构建了 3000 道验证题,每道题只考察单一感知能力,无需推理或外部知识。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3lggqj00c0roskhu1r5f09
Kimi K3 技术报告发布:百万 token 上下文与 2.5 倍效率提升
Kimi K3 发布技术报告,这是一款 2.8T MoE 模型,原生支持视觉理解与百万 token 上下文窗口。其架构和训练方案相比 Kimi K2 将整体扩展效率提升了约 2.5 倍,通过 Kimi Delta Attention、NoPE、跨深度注意力残差及 896 专家 MoE 等设计实现。模型权重、技术报告及配套高性能内核与基础设施已开源。 🔗 阅读原文 via AI HOT ·...
微软发布 MAI-Cyber 1 模型
微软发布 MAI-Cyber 1 模型,专注于网络安全领域。该模型在 Hacker News 上获得 111 个点赞,引发社区关注。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3l7opo003xroskfj1yfpz2
微软发布首个网络安全专用模型 MAI-Cyber-1-Flash 及 Perception 平台
微软推出其首个网络安全专用模型 MAI-Cyber-1-Flash,声称在 Cyber Gym 基准测试中击败了 Gemini、GPT 5.5 Cyber 等竞品。该模型与 GPT 5.4 绑定在 MDASH 框架内,用于发现复杂代码库中的漏洞。同时发布的 Perception 平台可部署红、蓝、绿三组 AI 智能体,预览版将于 11 月 3 日上线。 🔗 阅读原文 via AI HOT...
AI智能体Fable通过API生成数据幻灯片
与AI智能体对话太棒了。我刚让Fable用我们某个参考Olmo 2模型的KL距离真实数据制作一张幻灯片,它通过wandb API生成了这个(我稍微编辑了文字)。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3l7m5r003lrosk0h5qcy6w
前沿AI安全需开源生态,单一封闭系统不可靠
Rohan Paul指出,前沿系统不能依赖单一封闭模型,攻击者不会遵守供应商政策。引用JensenHuang观点:攻击者已拥有前沿AI,防御者需要由顶级开源和闭源模型组成的AI生态。Hugging Face事件中,封闭AI阻碍了关键取证,而开源权重前沿模型帮助遏制了入侵,这正是Open Secure AI Alliance成立的原因。 🔗 阅读原文 via AI HOT ·...
Kimi K3 上线 OpenCode Zen 平台
Kimi K3 现已在 OpenCode Zen 中可用。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3k5aui00i1roiycf2gvyae
Kimi K3 上线 Together AI,面向智能体工作流
Kimi K3 已在 Together AI 平台上线,成为其 Day 0 首发合作伙伴。该开放前沿模型专为代码、工具、视觉和研究等长时间运行的智能体工作流设计,通过高吞吐推理为开发者提供即时访问。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3kdvi600pfroiy8z6rgxui
Opus 5 在 SlopCodeBench 基准测试结果
换句话说,我们做了一些基准测试。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3k60x700jiroiy4pyoj9pr
用Claude和Python构建技能驱动的金融分析智能体
本教程基于Anthropic的financial-services仓库,用纯Python复现其技能驱动架构。通过解析SKILL.md文件构建可搜索技能注册表,并创建可复用SkillAgent,将金融分析剧本注入Anthropic Messages API,支持迭代工具调用循环。 🔗 阅读原文 via AI HOT ·...
用Claude和Python构建技能驱动的金融分析智能体
本教程基于Anthropic的financial-services仓库,用纯Python复现其技能驱动架构。通过解析SKILL.md文件构建可搜索技能注册表,并创建可复用SkillAgent,将金融分析剧本注入Anthropic Messages API,支持迭代工具调用循环。 🔗 阅读原文 via AI HOT ·...
SSI 与 NVIDIA 合作,算力将提升 10 倍
Ilya Sutskever 的 Safe Superintelligence(SSI)宣布与 NVIDIA 达成长期战略合作,NVIDIA 将进行大额投资,使 SSI 在未来 12 个月内算力提升 10 倍。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3k682i00jsroiy1kzlkhna
Kimi K3 上线 Together AI,面向智能体工作流
Kimi K3 已在 Together AI 平台上线,Together AI 作为其 Day 0 发布合作伙伴,为开发者提供针对编码智能体和生产工作负载优化的高吞吐推理服务。该模型专为代码、工具、视觉和研究等长时间运行的智能体工作流而设计。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3jba5u00doroiyzxyeidjn
月之暗面开源最强模型Kimi K3权重
Ethan Mollick 阅读了目前最强开源权重模型 Kimi K3 的权重文件,发现其首页以负值为主、末尾一串零,以及一个异常大的正值。Kimi K3 是月之暗面最新模型,为 2.8T MoE 架构,具备原生视觉理解与 1M token 上下文窗口,宣称每单位计算智能提升 2.5 倍。模型权重与技术报告已在 HuggingFace 和 GitHub 开源。 🔗 阅读原文 via AI...
GitHub Copilot 发布"Harness"工作流:用单一工具完成原型、规划、实现与代码审查
GitHub Copilot 推出"Harness"工作流,让开发者通过单一 AI 工具完成从原型设计、规划、实现到代码审查的完整软件开发流程,无需追逐多种新 AI 工具。该工作流强调实用性与集成性,旨在减少工具切换带来的效率损耗。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3n5wpl001sro82iax01xu3
GitHub Copilot 发布"Harness"工作流:用单一工具完成原型、规划、实现与代码审查
GitHub Copilot 推出"Harness"工作流,让开发者通过单一 AI 工具完成从原型设计、规划、实现到代码审查的完整软件开发流程,无需追逐多种新 AI 工具。该工作流强调实用性与集成性,旨在减少工具切换带来的效率损耗。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3n5wpl001sro82iax01xu3
GitHub Copilot 发布"全流程工作流":用单一工具完成原型、规划、实现与代码审查
GitHub Copilot 推出一个实用工作流,让开发者用单一工具完成软件原型设计、规划、实现与代码审查,无需追逐每款新 AI 工具。该工作流将 Copilot 的聊天、内联代码补全、代码审查与 GitHub Actions 集成,覆盖从需求到部署的完整闭环。 🔗 阅读原文 via AI HOT ·...
德里高等法院驳回印度新闻机构 ANI 对 OpenAI 的版权禁令请求
德里高等法院驳回印度新闻机构 ANI 对 OpenAI 的初步禁令请求,认为 ANI 未能证明 ChatGPT 逐字复制其文章,且提交的文章发表于模型训练之后。法官认定 OpenAI 与 ANI 分属不同行业,未造成经济损失,并肯定大语言模型对教育、研究和可访问性的公共利益。法院初步将 AI 训练视为"私人或个人使用,包括研究"的例外,但要求训练数据必须来自合法来源。 🔗 阅读原文 via...
本体论演讲4天10万播放,AI工程新趋势
swyx 指出,Frank Coyle 教授关于"本体论(ontologies)"的演讲在4天内获得10万播放量,这在没有大厂助推和炒作话术的情况下尤为难得。swyx 看好这类由教授和YouTuber担任行业会议主题演讲的趋势,认为他们演讲能力强、偏见少、能浓缩多年思考。 🔗 阅读原文 via AI HOT ·...
SGLang 和 Miles 为月之暗面 2.8T 参数 Kimi K3 模型提供发布当日支持
SGLang 和 Miles 为月之暗面开源的 2.8T 参数模型 Kimi K3 提供发布当日支持,分别负责推理和 RL 训练。K3 采用 69 层 KDA 线性注意力与 24 层 MLA 交错的混合架构,在 SGLang 上单卡 batch-1 解码速度达约 113 tok/s,结合 DSpark 推测解码可达约 423 tok/s。 🔗 阅读原文 via AI HOT ·...
SGLang 和 Miles 为月之暗面 2.8T 参数 Kimi K3 模型提供发布当日支持
SGLang 和 Miles 为月之暗面开源的 2.8T 参数模型 Kimi K3 提供发布当日支持,分别负责推理和 RL 训练。K3 采用 69 层 KDA 线性注意力与 24 层 MLA 交错的混合架构,在 SGLang 上单卡 batch-1 解码速度达约 113 tok/s,结合 DSpark 推测解码可达约 423 tok/s。 🔗 阅读原文 via AI HOT ·...
Bolt 签署开放权重与 AI 领导力公开信
Bolt 签署了"开放权重与美国 AI 领导力"公开信。该公司此前已加入开源承诺(Open Source Pledge),并开源了自身产品。Bolt 认为开放权重是其长期支持开源基础设施的合理延续。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3j11zk003sroiyevn02q5o
Opus 5 在 SlopCodeBench 基准测试结果
第一和第二部分合计超过 70 万次观看。现在你可以阅读第三部分--在 SlopCodeBench 上对 Opus 5 进行基准测试 http://x.com/i/article/2081753730534506496 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3k60x700jjroiyzvuhq8gh
Emad 调侃 ChatGPT 改名像 Ryanair
我总觉得这是瑞安航空 是我老了吗 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cms3iyw560025roiytyxtnf2d