RSS

  • 宝玉的分享
    https://baoyu.io/feed.xml
    刷新于
  • AIHOT 日报
    https://aihot.virxact.com/feed/daily.xml
    刷新于
  • AIHOT — 全部 AI 动态
    https://aihot.virxact.com/feed/all.xml
    刷新于
  • AIHOT — 精选
    https://aihot.virxact.com/feed.xml
    刷新于

布林推动谷歌AI递归自我改进

据报道,谢尔盖·布林正将谷歌的AI资源转向递归自我改进。 路透社称,布林已敦促核心员工追赶前沿,并将资源推向无需人工干预即可自我改进的AI。 在Anthropic凭借Claude Mythos领先之后,压力加剧。谷歌随后将其下一代旗舰Gemini模型推迟了两个月,因为内部测试显示该模型在编码等领域落后于竞争对手。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

Grok 4.7 将超越所有现有模型

马斯克称 Grok 4.7 将超越所有现有模型,并称 SpaceX 训练语料独特,在真实工程任务上难有敌手。博主认为 Grok 4.6 已是期待中的飞跃,若 10T 参数模型尚未发布,马斯克所言或可成真。同时指出 Anthropic 的 Fable 5.5 蓄势待发,未来数周竞争将十分激烈。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

MiniMax H3 与 fal 联办线上分享会

MiniMax H3 × @fal 🎙️ 本周四,fal 创意工程师 @OdinLovis、MiniMax AI 解决方案架构师 Ethan Wei 以及 MiniMax GTM 工程师 @VictorSuOrtiz 将共同直播,深入解析创作者和开发者如何基于 H3 进行构建。 我们将涵盖多模态引用、原生音频、提示词、LoRA 与定制化、开放权重,以及 fal 上真实的创意与技术工作流。...

noreply@aihot.virxact.com (X:MiniMax (@MiniMax_AI))

GitHub Copilot 应用如何写出你的第一条提示词

GitHub Copilot 应用发布入门指南,教用户写出第一条提示词,并学会选择合适的上下文与模型,从而自信地开启首个任务。该指南面向 Copilot 应用的新手用户,帮助其快速上手提示词编写。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsqiju8r0417roxvbqlhkvcm

noreply@aihot.virxact.com (GitHub Blog)

与Ajambrosino的典型对话与期待

与 @ajambrosino 的典型对话 A:核心对齐已经达成 T:你说核心对齐 A:我是说 T:多说点 A:更多 然而,我从未对他和团队正在构建的东西感到如此兴奋。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsqgi90j02q5roxvfhmvqxg5

noreply@aihot.virxact.com (X:Tibo (@thsottiaux))

Grok 4.6 登陆 Conductor,性能比肩 GPT 5.6 Sol

Grok 4.6 已在 Conductor 上线! 所有基准测试均表明,其性能与 GPT 5.6 Sol 不相上下。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsqhjp6d0364roxvj7iaoswf

noreply@aihot.virxact.com (X:Charlie Holtz(@charlieholtz))

马斯克称Grok 4.7将超越所有现有模型

👀 看起来很有可能。 【引用 @elonmusk】:@cognition Grok 4.7 将超越所有现有模型。 话虽如此,Anthropic 是一家伟大的公司,可能很快就会发布改进后的模型。 然而,SpaceX 训练语料库如此出色且独特,如果有任何模型在真实工程领域比 4.7 更强,我会感到震惊。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

Cognition洽谈400亿美元估值,年化收入近10亿

彭博社:Cognition 正在洽谈超过 400 亿美元的估值,而就在 3 个月前其估值刚以 260 亿美元收官。 新一轮融资可能超过 10 亿美元,而 Cognition 的年化收入运行率目前已接近 10 亿美元,因此估值是其年化收入的 40 倍。 Cognition 在 5 月份报告的年化运行率为 4.92 亿美元,同时 Devin 的企业使用量在 6 个月内实现了 50%...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

26款商用LLM混合成本对比:Grok 4.6性价比最强

26款商用大模型每百万token混合成本对比显示,Grok 4.6在Fable 5智能指数得分61分,仅比Claude Fable 5 Max的62分低1.6%,但输入token成本低80%($2 vs $10/M),输出token成本低88%($6 vs $50/M),成为智能-价格比最优选择。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

DeepSeek v4 Pro 1.5T 发布,大幅超越 Nemotron3 Ultra

祝贺 @deepseek_ai 发布 DeepSeekv4 Pro 0813 1.5T🔥 它在智能体任务上大幅超越 Nemotron3 Ultra。 此外,DeepSeekv4 Flash 0731 同样大幅超越 Nemotron3 Ultra,而活跃参数少 4.2 倍,总参数也少近 2 倍! Nemotron 团队有很多优秀的人才,但根本上,委员会式的模型前沿开发是行不通的。👇️...

noreply@aihot.virxact.com (X:SemiAnalysis (@SemiAnalysis_))

MiniMax H3 与 fal 联办 X Spaces 直播

MiniMax H3 × @fal 🎙️ 明天,加入 fal 创意工程师 @OdinLovis、MiniMax AI 解决方案架构师 Ethan Wei 和 MiniMax GTM 工程师 @VictorSuOrtiz,一起直播拆解创作者和开发者如何在 fal 上用 H3 进行构建。 我们将涵盖多模态参考、原生音频、提示词、LoRA + 定制化、开放权重,以及 fal...

noreply@aihot.virxact.com (X:MiniMax (@MiniMax_AI))

Peter Steinberger 今日做客 ClawCast

即将上线! 【引用 @openclaw】:@steipete 将于今天(周三)上午 11:30(太平洋时间)加入 ClawCast 欢迎来 Discord 加入我们的直播问答播客录制 https://openclaw.ai/podcast 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsqg352c0217roxvin69a78q

noreply@aihot.virxact.com (X:Peter Steinberger (@steipete))

CLAUDE.md 为何不断膨胀?研究揭示修复方案

一项针对 1,867 个仓库中 247,694 条指令生命周期的研究发现,CLAUDE.md 等文件会无限膨胀:提示词在其生命周期内增长超三倍,每次提交净增 4.9 条指令,且指令越旧越难被删除。研究提出的修复方案是为指令添加注释说明理由,在可验证环境中可消除 99.3% 的多余指令,并将真实智能体指令遵循率提升最高 23.1%。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Elvis Saravia (@omarsar0, DAIR.AI))

Grok 4.6与DeepSeek 4 Pro GA价格战白热化

性能与价格正成为AI模型竞争核心。Grok 4.6已跻身顶级行列,但价格显著优于对手;DeepSeek 4 Pro GA定价更低,$0.435/M输入、$0.87/M输出,支持1M-token上下文,性价比优势愈发关键。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsqf0csx010iroxvvnpbobd9

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

MiniMax H3 与 fal 联办 X Spaces 直播

MiniMax H3 × @fal 🎙️ 明天,fal 创意工程师 Lovis Odin、MiniMax AI 解决方案架构师 Ethan Wei 和 MiniMax GTM 工程师 @VictorSuOrtiz 将一起直播,深入解析创作者和开发者如何在 Fal 上使用 H3 进行构建。 我们将涵盖多模态引用、原生音频、提示词、LoRA + 定制化、开放权重,以及 fal...

noreply@aihot.virxact.com (X:MiniMax (@MiniMax_AI))

SpaceXAI的Grok 4.6在"人工智能分析指数"中获得61分

SpaceXAI的Grok 4.6在人工智能分析指数中得分61,与GPT-5.6 Sol持平,仅次于Claude Opus 5和Claude Fable 5。其智能体性能突出,GDPval-AA v2 Elo达1753,定价维持$2/$6每百万token,较Claude Opus 5和GPT-5.6 Sol低60%以上。上下文窗口为500k tokens,每任务成本$0.84。 🔗...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

Soniox TTS v2 发布:60+ 语言与超低价

Soniox 发布 TTS v2,单一模型支持 60+ 种语言,生成音频每小时仅 $0.70,并内置情感标签、克隆与毫秒级时间戳。该模型专为实时语音智能体设计,支持打断恢复与跨语言身份保持,已在美欧日上线,兼容 v1。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsqf0f730126roxvi9fdg6hr

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

马斯克推荐试用Grok Bot智能体

试试 Grok @Bot 【引用 @yunta_tsai】:Grok Bot 能够 a) 浏览日历,找出我尚未完成但需要提前预订的事项,b) 确定最佳预订时间,c) 在网站上完成预订操作。 在我走到车前穿过停车场时,我正用中英混合的语言与它对话。 印象深刻。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Elon Musk (@elonmusk, xAI))

DeepSeek-V4-Pro-0813 长程任务早停引质疑

DeepSeek-V4-Pro-0813 在 reasoning_effort=max 时,长程 AgenticCoding 任务(50 轮代码优化)中 3 次测试有 2 次在 42-43 轮提前停止,未用完全部机会,且成绩未超过 GLM-5.1。作者推测可能与强化学习奖励机制或上下文窗口注意力衰减有关,将发布详细评测视频。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:karminski (@karminski3))

Grok 4.6 上线,7 天双倍 token

试试 Grok 4.6! 接下来 7 天 token 翻倍。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsqf0eus011rroxvys05b4jq

noreply@aihot.virxact.com (X:Elon Musk (@elonmusk, xAI))

AutoGPT 如何用 AGENTS.md 和技能门控管理 AI 生成的拉取请求

AutoGPT 维护者发现,AI 智能体不会主动阅读文档,因此将指令放在 AGENTS.md 和技能文件中,并置于代码目录旁。他们通过强制 PR 模板、测试计划、CI 覆盖率门槛和 CLA 签名等门控机制,将智能体提交的 PR 从"不可用"转变为"可用但不符合路线图"。其中 CLA 签名因需浏览器和 OAuth 流程,被用作区分人类与智能体的"人类探测器"。 🔗 阅读原文 via...

noreply@aihot.virxact.com (GitHub Blog)

AutoGPT 如何用 AGENTS.md 和技能门控管理 AI 生成的拉取请求

AutoGPT 维护者发现,AI 智能体不会主动阅读文档,因此将指令放在 AGENTS.md 和技能文件中,并置于代码目录旁。他们通过强制 PR 模板、测试计划、CI 覆盖率门槛和 CLA 签名等门控机制,将智能体提交的 PR 从"不可用"转变为"可用但不符合路线图"。其中 CLA 签名因需浏览器和 OAuth 流程,被用作区分人类与智能体的"人类探测器"。 🔗 阅读原文 via...

noreply@aihot.virxact.com (GitHub Blog)

Replit 新增工作区托管区域选择

想要降低 Replit 中的延迟,并控制项目预览的托管位置? Pro 和企业版客户现在可以选择新 Replit 工作区的托管位置。 可在北美、欧洲或亚洲之间选择。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsqf96b2016lroxvy4gju01z

noreply@aihot.virxact.com (X:Replit (@Replit))

空货架还是丢钥匙?Google 研究:Recall 是参数化事实性的瓶颈

Google Research 提出知识画像框架,发现前沿 LLM(如 Gemini3、GPT-5)的事实编码接近饱和,但回忆(recall)能力不足,多数事实错误源于"丢钥匙"而非"空货架"。该框架将事实分为编码失败、回忆失败等五类画像,并配套推出 WikiProfile 基准,含 2,150 条维基百科事实,每条配 10 个问题,用于分别探测编码、回忆与识别能力。 🔗 阅读原文 via...

noreply@aihot.virxact.com (Google Research:Blog(网页))

空货架还是丢钥匙?Google 研究:Recall 是参数化事实性的瓶颈

Google Research 提出知识画像框架,发现前沿 LLM(如 Gemini3、GPT-5)的事实编码接近饱和,但回忆(recall)能力不足,多数事实错误源于"丢钥匙"而非"空货架"。该框架将事实分为编码失败、回忆失败等五类画像,并配套推出 WikiProfile 基准,含 2,150 条维基百科事实,每条配 10 个问题,用于分别探测编码、回忆与识别能力。 🔗 阅读原文 via...

noreply@aihot.virxact.com (Google Research:Blog(网页))

Grok 4.6 以更低价格逼近 Fable 5 智能指数

Grok 4.6 在 Fable 5 的 Intelligence Index 上取得 98.4% 的分数,输入 token 价格便宜 5 倍、输出 token 便宜 8 倍。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsqf0f730127roxvfu5wtcec

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

Grok 4.6 登顶 AA-Briefcase,成本远低于竞品

Grok 4.6 在 Artificial Analysis 的 AA-Briefcase 智能体知识工作基准上取得大幅提升,与 Claude Fable 5 并列领先(置信区间重叠)。其单任务成本仅 $4.42,远低于 Claude Fable 5 的 $22.30、Claude Opus 5 的 $17.79 和 Kimi K3 的 $6.73。该测试集为私有,可防止数据污染。 🔗...

noreply@aihot.virxact.com (X:Artificial Analysis (@ArtificialAnlys))

Grok 4.6 发布:价格不变、智能跃升第一梯队

Grok 4.6 今日上线,价格与 4.5 完全一致($2/M input、$6/M output),约为其他前沿模型一半,但智能大幅跃升。AA智能指数达61,与GPT-5.6 Sol Max持平,仅比Fable 5低1分;GDPVal、AA-Briefcase均拿第一,法律基准15.8%断层领先。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:阿易 AI Notes (@AYi_AInotes))

Higgsfield 插件上线 ChatGPT 应用

Higgsfield 插件正式上线 ChatGPT 应用,用户可直接在聊天中生成与编辑图像,无需 API key,使用现有 Higgsfield 积分即可。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsqeu3h7001oroxvupy2ooyy

noreply@aihot.virxact.com (X:Elvis Saravia (@omarsar0, DAIR.AI))

AI安全担忧升温,三位先驱为何主张保持开放

在拉斯维加斯Ai4大会上,Geoffrey Hinton、李飞飞和吴恩达一致主张AI应保持开放,反对少数大公司垄断技术进程。吴恩达强调"不希望有守门人",并担忧美国开源AI难以与中国开源权重模型竞争;Hinton虽曾反对开放权重,但承认"这场战斗已经输了";李飞飞则主张分层开放。三人均认同需要一定程度的监管。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (TechCrunch:AI(RSS))
上一页 第 5 / 851 页 下一页

添加 Feed

导入 OPML