RSS

  • 宝玉的分享
    https://baoyu.io/feed.xml
    刷新于
  • AIHOT 日报
    https://aihot.virxact.com/feed/daily.xml
    刷新于
  • AIHOT — 全部 AI 动态
    https://aihot.virxact.com/feed/all.xml
    刷新于
  • AIHOT — 精选
    https://aihot.virxact.com/feed.xml
    刷新于

Anthropic 与 Bitdeer 签署百亿算力协议

Anthropic 刚刚与 Bitdeer 和 Volta Infra(一家由前 Brookfield 高管创立的初创 neocloud 公司)签署了一份 100 亿美元的算力协议。 随着 Claude Code 需求飙升,这笔额外的算力变得十分必要 🚀 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsf00q301cevro2ek7dup1cb

noreply@aihot.virxact.com (X:SemiAnalysis (@SemiAnalysis_))

Soup v0.72.4:在4 GB显存笔记本GPU上微调8B模型

Soup 推出 v0.72.4,支持在配备 4 GB 显存的笔记本 GPU 上通过 QLoRA 微调 8B 模型,无需 SSH 或云服务。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsezylz31cadro2eoq1np3vh

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

Soup v0.72.4:在4 GB显存笔记本GPU上微调8B模型

Soup 推出 v0.72.4,支持在配备 4 GB 显存的笔记本 GPU 上通过 QLoRA 微调 8B 模型,无需 SSH 或云服务。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsezylz31cadro2eoq1np3vh

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

Edelman、Le Truc 与 WHY Brands 谈 AI 为何奖励有观点的创作者

三家广告与品牌公司的创意负责人一致认为,AI 技术已成熟,真正挑战在于重塑习惯、团队与预算。Le Truc 的 Williander 强调快速原型、展示 60-70% 完成度即可;Edelman 引入 Runway 后设计师效率提升五倍;WHY Brands 的 Harrelson 用 AI 实现当天响应文化热点。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (Runway:News(网页))

Artificial Analysis 推出端点精度指数,衡量 serverless API 保留开源模型原始精度的程度

Artificial Analysis 发布端点精度指数,以官方权重自托管部署为基准(100%),从工具调用、科学推理和长上下文召回三维度评测各 serverless API 端点。首批覆盖 GLM-5.2、gpt-oss-120b 和 DeepSeek V4 Pro,Kimi K3 即将加入。结果显示输出 token 限制和工具调用处理方式会显著拉低部分端点得分。 🔗 阅读原文 via...

noreply@aihot.virxact.com (X:Artificial Analysis (@ArtificialAnlys))

Mistral 发布 3B 开源安全模型 Shieldstral

Mistral AI 宣布推出 Shieldstral,一款用于内容安全的全新 3B 开源权重模型。 > 一款 3B 开源权重、策略自适应的多模态安全分类器,在文本安全方面可媲美最高 7 倍体量的模型,并在多模态审核方面树立了新标杆。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsez79wl1bsdro2em0ivvap6

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))

OpenRouter 上线 FLUX 3 Video 统一多模态模型

@bfl_ai 的 FLUX 3 Video 现已在 OpenRouter 上向所有人开放。 一个统一的视频、音频、图像和动作预测多模态模型家族。严肃、有趣、创意、真实、电影感,随你所需。基于统一架构联合训练。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmseyrhcj1bgmro2ed47t5b0k

noreply@aihot.virxact.com (X:OpenRouter (@OpenRouter))

OpenRouter 上线 FLUX 3 Video 统一多模态模型

@bfl_ai 的 FLUX 3 Video 现已在 OpenRouter 上向所有人开放。 一个统一的视频、音频、图像和动作预测多模态模型家族。严肃、有趣、创意、真实、电影感,随你所需。基于统一架构联合训练。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmseyrhcj1bgmro2ed47t5b0k

noreply@aihot.virxact.com (X:OpenRouter (@OpenRouter))

Gemini Spark 自动生成每周 AI 新闻摘要

Google Labs 副总裁 Josh Woodward 转发用户案例:用户仅用一条提示词设置 Gemini Spark,即可每周自动在 Drive 创建文档、筛选 5 条重大 AI 新闻并生成带标题、摘要和来源链接的简报。该任务按计划自动运行,无需人工干预,可用于自动化任何重复性工作。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Josh Woodward (@joshwoodward, Google Labs VP))

SpecForge v0.3.0 发布:统一解耦与共置投机解码栈,新增开放 SpecBundle 草稿模型

SpecForge v0.3.0 将目标模型推理与草稿模型训练分离,支持 EAGLE3、EAGLE3.1、P-EAGLE、DFlash、Domino、DSpark 等多种投机解码算法,并统一在线、离线与解耦工作流。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmseyfjcz1au8ro2enx0b7os6

noreply@aihot.virxact.com (LMSYS:Blog(Chatbot Arena 团队))

SpecForge v0.3.0 发布:统一解耦与共置投机解码栈,新增开放 SpecBundle 草稿模型

SpecForge v0.3.0 将目标模型推理与草稿模型训练分离,支持 EAGLE3、EAGLE3.1、P-EAGLE、DFlash、Domino、DSpark 等多种投机解码算法,并统一在线、离线与解耦工作流。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmseyfjcz1au8ro2enx0b7os6

noreply@aihot.virxact.com (LMSYS:Blog(Chatbot Arena 团队))

OpenAI 首次网红品牌之旅为何引发争议

OpenAI 上周末组织了一场名为"Summer Club"的网红品牌之旅,邀请多位职业与商业领域创作者前往纽约郊外度假村,展示品牌周边并宣传 ChatGPT。活动引发大量网友批评,指责其忽视 AI 的环境影响与就业替代问题,部分视频评论称"人们会为了免费酒店出卖灵魂"。OpenAI 回应称创作者是其社区重要组成部分,活动旨在教育,并欢迎健康辩论。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (The Verge:AI(RSS))

HyperAgent 成 Airtable 新篇章,1.285B 收购引热议

我们是 Airtable 的忠实粉丝--AIE 就运行在 Airtable 上--所以看到这个数字可能令人意外,但别小看 @howietl! 如果你参加过 WF26,应该已经见过 @hyperagentapp,那是 Airtable 团队的下一篇章! 【引用 @fedesimio】:我们已正式达成协议,以 12.85 亿美元收购 Airtable!😍 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:swyx (@swyx))

Gemini Omni 今晚限时免费生成十个视频

在 Gemini Omni 中免费创建十个视频,截止时间为太平洋时间今晚 11:59。 可在网页端或应用中尝试,并在回复中分享你的作品。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmseyy35u1bmbro2ezt5l975w

noreply@aihot.virxact.com (X:Gemini (@GeminiApp))

Krea 发布 FLUX 3,支持真实世界交互

推出 FLUX 3。 不止于视频,这是首个通过全新动作预测系统支持与真实世界交互的模型。 现已登陆 Krea,更多模态即将推出。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsexviky1akfro2e5pmlbntn

noreply@aihot.virxact.com (X:Krea AI (@krea_ai))

"不健康"的LLM使用比想象中更普遍

YouTuber Hank Green因被批评使用AI而暂停内容制作,称自己的AI使用"不健康",但强调仅用于查找研究资料而非撰写脚本。专家指出,AI聊天机器人天生为持续对话而设计,类似社交媒体,可能在引发精神危机前就导致强迫性依赖、认知卸载和批判性思维下降。OpenAI称其周活跃用户已超9亿,即便仅部分使用不健康,受影响人数也可能达数百万。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (The Verge:AI(RSS))

Sierra 发布 Context Engine:让智能体基于企业知识自主决策

Sierra 推出 Context Engine,将企业知识转化为智能体可执行的决策,支持 Horizon 智能体在数天、数周或数月内持续追求业务成果。每次交互都会让下一次更智能,使企业的竞争优势随时间累积。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsezunsh1c8tro2evwx5xwn3

noreply@aihot.virxact.com (Sierra:Blog(RSS))

DeepSeek Harness 开源项目内测招募启动

DeepSeek 官方发起 DSH(DeepSeek Harness)内测招募,面向 Agent Harness 相关开源项目作者。入选者可获内测资格及部分 API 额度,实现 DSH 发布时第一时间接入支持。参与需回复 GitHub id、项目地址及邮箱。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Tianyi Cui(@tianyi))

苹果寻求初步禁令,称更多前员工可能将机密数据带到OpenAI

苹果在针对OpenAI的商业机密案中寻求初步禁令,并申请加快取证,指控更多前员工可能参与泄密。除已起诉的刘昌和谭约伟外,调查又发现11名前苹果员工可能涉案。OpenAI回应称该请求"基于虚假信息且完全没必要",强调"没有也不想要"苹果的商业机密。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsextgmd1agdro2ebut8058x

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

今年普利策奖创纪录:8位获奖者披露使用AI

今年普利策奖创纪录地有8位获奖者披露使用AI,包括5位获奖者和3位入围者,披露要求自2024年起实施。获奖者主要用AI和大语言模型快速检索海量文件,如《华尔街日报》用内部LLM总结得州洪水文件,美联社用LLM搜索数万份监控技术泄密文件,《纽约时报》用GPT-5核查SEC加密案件分类。普利策管理员称新闻业已接受"AI将长期存在",明年起图书类作品也需披露。 🔗 阅读原文 via AI HOT...

noreply@aihot.virxact.com (The Decoder:AI News(RSS))

SlopCodeBench 新结果:Fable 5、GPT-5.6-Sol、Kimi K3

应大家要求--新前沿模型 SlopCodeBench 结果出炉:Fable 5、GPT-5.6-Sol 和 Kimi K3 直播现在开始,回顾结果!!!http://x.com/i/article/2083255912949788672 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsextmvz1ah3ro2e4w5o5zbe

noreply@aihot.virxact.com (X:Dex Horthy(HumanLayer)(@dexhorthy))

SlopCodeBench:AI 编程基准评测新标准

SlopCodeBench:🦄 真正可用的 AI 第 68 期 https://x.com/i/broadcasts/1PKqrrMqaQdGb 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsextmvz1ah4ro2ewlojbqaf

noreply@aihot.virxact.com (X:Dex Horthy(HumanLayer)(@dexhorthy))

Not Diamond Code 发布,推理路由层降本 20%+

Not Diamond 发布 Not Diamond Code,一个为长时程编码智能体设计的模型路由层,可在每一步切换模型。官方称其可将成本降低 20% 以上且不损失整体任务质量,并兼容 Claude Code 等网关。在基准测试中,混合路由策略相比 Anthropic 单一策略性能提升 3.6%,节省成本从 39% 增至 66%。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

如何用 LangSmith 评估语音智能体

LangChain 官方博客介绍如何用 LangSmith 评估语音智能体,覆盖执行、结果与来电者体验三个层面。评估手段包括 LangSmith traces、代码评估器、LLM judges 和人工审查,帮助开发者系统化验证语音智能体的实际表现。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsexo9221aboro2erse3g0ov

noreply@aihot.virxact.com (LangChain:Blog(RSS))

Gemini Notebook 升级版全面上线

升级版 @Gemini_Notebook 体验现已向所有用户开放!Gemini 现在可以直接在聊天中生成多种文件类型并进行研究。 现在我们需要应用了👀 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsex23r119slro2e2v22z81o

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))

Locus 登顶 PostTrainBench,后训练 Qwen3 超越人工

Locus 自动化 AI 研究系统在 PostTrainBench 上达到 SOTA,其后训练的 Qwen3 基础模型超越人工后训练的 Qwen3 模型,相关 LLM 已投入生产服务数百万用户。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsexo89i1abmro2eifbfakam

noreply@aihot.virxact.com (X:Karina Nguyen(@karinanguyen))

Perplexity CEO强调智能体研究验证关键

在进行高风险研究时使用智能体,验证是关键! 【引用 @jeffgrimes9】:Perplexity Computer 金融查询中的每个数值都可追溯到原始值,并显示完整的计算轨迹。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsey5jdy1asvro2ensfy78d4

noreply@aihot.virxact.com (X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas))

Mariano-Florentino (Tino) Cuéllar 加入 Anthropic 出任首席全球事务官

Anthropic 任命 Mariano-Florentino (Tino) Cuéllar 为首任首席全球事务官,负责全球政策、国际战略参与及政府关系事务。Cuéllar 曾任卡内基国际和平基金会主席、加州最高法院法官,并自 2026 年 1 月起担任 Anthropic 长期利益信托受托人,现已卸任该职务加入公司。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (Anthropic:Newsroom(网页))

PixVerse Live 直播倒计时48小时

⏰ 仅剩48小时。将创意实时转化为视频。8月6日(太平洋时间上午10-11点)加入PixVerse Live,参与实时问答、创意基础讲解,并观看实时制作的真实视频。 🎁 5,000 PixVerse积分等你来拿。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmsewt1u319ogro2eghxmtx46

noreply@aihot.virxact.com (X:PixVerse (@PixVerse_))

Claude 工具调用频率分析:Fable 5 逆势领先

Claude 使用工具的频率如何? 我们查看了收集到的 227 万条 Claude 响应来寻找答案。 Opus 模型从 Opus 4.6 到 Opus 4.8 的工具调用呈现明显下降趋势。然而,Fable 5 打破了这一模式,平均每条响应调用 1.00 次工具,而 Opus 4.8 为 0.76 次,Opus 5 为 0.79 次。(1/2)🧵 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:SemiAnalysis (@SemiAnalysis_))
上一页 第 147 / 914 页 下一页

添加 Feed

导入 OPML