RSS

  • 宝玉的分享
    https://baoyu.io/feed.xml
    刷新于
  • AIHOT 日报
    https://aihot.virxact.com/feed/daily.xml
    刷新于
  • AIHOT — 全部 AI 动态
    https://aihot.virxact.com/feed/all.xml
    刷新于
  • AIHOT — 精选
    https://aihot.virxact.com/feed.xml
    刷新于

Codex 与 Sol 实现图最大化工作流

我现在是图工程师了吗 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmrzien1i000wrokhl4uuetfk

noreply@aihot.virxact.com (X:Peter Steinberger (@steipete))

Midjourney V8.2 发布:专注美学提升与个性化理解

Midjourney 今日推出 V8.2 图像模型,重点提升美学质量、图像创意与个性化表现。低质量图像出现频率将显著降低,个性化功能能更精准理解用户审美偏好。V8.2 的个性化配置文件拥有更大、更优的图像选择池,建议用户尝试新旧配置文件体验最新版本。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmrzi9yew001arop9eruk86n7

noreply@aihot.virxact.com (Midjourney:Updates(RSS))

Midjourney V8.2 发布:专注美学提升与个性化理解

Midjourney 今日推出 V8.2 图像模型,重点提升美学质量、图像创意与个性化表现。低质量图像出现频率将显著降低,个性化功能能更精准理解用户审美偏好。V8.2 的个性化配置文件拥有更大、更优的图像选择池,建议用户尝试新旧配置文件体验最新版本。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmrzi9yew001arop9eruk86n7

noreply@aihot.virxact.com (Midjourney:Updates(RSS))

黄仁勋从洗碗工到英伟达联合创始人的历程

Jensen Huang 很酷。 1963: 出生 1978: 在 Denny's 餐厅开始做洗碗工 1978-1983: 担任洗碗工、餐厅杂工和服务员 1993: 联合创立 NVIDIA 2026: 加入 X 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmrziem08000orokhqh48dmzg

noreply@aihot.virxact.com (X:cb_doge (@cb_doge))

Perplexity 上线 Claude Opus 5,性能超群且成本低 57%

Claude Opus 5 现已在 Perplexity 和 Perplexity Computer 中可用。 我们在 WANDR 上将其与其他六个模型进行了评估。它的表现优于除 Fable 5 之外的所有模型,同时成本低 57%。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmrzifb28002brokhbbi2dnmu

noreply@aihot.virxact.com (X:Perplexity (@perplexity_ai))

Claude Opus 5 登顶 AA-Briefcase 智能体知识工作基准

Claude Opus 5 在 AA-Briefcase 基准上以 1720 Elo 位居榜首,领先 Claude Fable 5 达 146 分。其 max 设置下每任务成本为 $17.79,较 Fable 5 降低 20%;high 设置以 $10.41 的成本(不到 Fable 5 一半)仍领先 32 Elo。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Artificial Analysis (@ArtificialAnlys))

Agentic Context Management 论文提出五大原语

论文指出生产级AI智能体失败更多源于上下文管理而非推理能力,并提出架构、摄取、范围界定、预测和压缩五大原语。其参考实现在LongMemEval和LoCoMo基准上分别达到92%和93.2%的准确率,通过保真度验证的压缩可在线性成本下保留关键信息。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmrzic2d9002rrop9a17pxo98

noreply@aihot.virxact.com (X:Elvis Saravia (@omarsar0, DAIR.AI))

Replit 本周四大更新:移动端与降价

本周 Replit 动态 本周四大重磅发布: 1) 全新移动端应用体验,随时随地构建 2) 部署成本降低 50% 以上,部分情况高达 80% 3) 全新统一工具面板,一切尽在一处 4) Replit MCP 进入测试版,可从任何地方调用 Replit Agent 详细内容 🧵 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Replit (@Replit))

Anthropic 与美国国防部关系再陷僵局,Opus 5 性能超 Fable 5

Anthropic 与美国国防部(DoW)的关系再度紧张。距 DoW 解除对 Fable 5 的出口管制仅 3 周,Anthropic 的 Opus 5 在多数基准测试上已实际超越 Fable 5。DoW 官员称 Anthropic 拒绝允许其 AI 模型用于合法军事用途,相关产品正被全面移除。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

Opus 5 在 FrontierCode 上呈现非单调成功-努力曲线

Opus 5 在 FrontierCode 上呈现有趣的非单调成功-努力曲线 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmrzics7m0055rop94qc8yr38

noreply@aihot.virxact.com (X:Thomas Wolf(Hugging Face 联创/CSO) (@Thom_Wolf))

Anthropic 发布 Claude Opus 5:前沿级智能体编程与计算机使用能力,Opus 定价不变

Anthropic 推出 Claude Opus 5,取代 Opus 4.8 成为 Opus 系列旗舰模型。定价维持不变,输入每百万 token 5 美元、输出每百万 token 25 美元。Anthropic 称 Opus 5 的智能水平接近 Claude Fable 5,但价格仅为后者一半。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (MarkTechPost(RSS))

Gemini Spark 新增日历 PDF 自动导入功能

Gemini 不仅能聊天,还能帮你完成任务。 今天的用例:放入一份学校日历 PDF。告诉 Gemini 将所有"无课日"添加到你的 Google 日历中。搞定。 📍Gemini Spark 现已面向美国所有 Google AI Pro 订阅用户上线,接下来将全球扩展。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Josh Woodward (@joshwoodward, Google Labs VP))

BaoCut 新增视频画面翻译功能,支持 Agent 自动化

BaoCut v0.8.2 上线视频画面翻译功能,可对视频帧进行 OCR 识别并叠加翻译字幕。支持通过 Agent(推荐 Codex)自动化操作,无需人工干预;翻译结果可直接导出到剪映(CapCut)二次处理。用户也可在 GUI 中手动暂停、选择文字区域,批量翻译效率更高。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:宝玉 (@dotey))

MiniMax 推出"开放智能"系列研讨会

MiniMax 宣布启动"开放智能"系列研究活动,首场将于7月28日在旧金山举办。活动聚焦推理、AI智能体和评估,邀请来自ProtegeAI、Together Compute、Artificial Analysis和KeenableAI的研究者分享前沿工作,包括临床LLM反事实评估、测试时学习发现、前沿智能体知识工作评估及结构化多智能体推理等议题。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:MiniMax (@MiniMax_AI))

加拿大议员在议会演讲中读出疑似 LLM 提示词指令

加拿大新不伦瑞克省进步保守党议员 Bill Oliver 在议会演讲中念出"这是一个更自然、流畅的版本"等明显带有 LLM 提示词特征的句子,疑似将 AI 生成的替代文本直接读入会议记录。该视频本周在 Reddit 和 Threads 等社交平台传播,并引发加拿大广播公司等主流媒体关注。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (Ars Technica:AI(RSS))

Claude Opus 5 在 Three.js 硬编码测试中以 3/4 价格击败 Fable 5

Claude Opus 5 在 Three.js 硬编码测试中生成 2,738 行代码,视觉效果最佳,成本仅 $6.22,为 Fable 5($8.12)的 3/4。Opus 5 在 frontier-bench v0.1(43.3%)等基准达 SOTA,但 agentic 编码部分仍落后于 Fable 5。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

Anthropic 发布 Opus 5,聚焦 token 效率而非能力飞跃

Anthropic 今日推出 Opus 5,这是其热门编程模型的最新更新。与 Opus 4.5 在智能体编码性能上的突破不同,Opus 5 主要提升 token 效率,而非带来能力上的大幅飞跃。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmrzg9w7y015rro2ivuvvgumc

noreply@aihot.virxact.com (Ars Technica:AI(RSS))

新模型系统提示词应精简,避免干扰能力

针对新模型,Claude Code 系统提示词被删减约 80%,核心原则是避免干扰模型能力。系统提示词应只存储偏好信息,而非替代模型功能。当前最大挑战是评估与验证结果,HTML 工件可加速这一过程。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmrzg6w7i0106ro2ikjzib8tz

noreply@aihot.virxact.com (X:Elvis Saravia (@omarsar0, DAIR.AI))

Codeberg 新规禁止AI生成代码项目,引发开源社区分歧

Codeberg 更新服务条款,禁止托管主要由生成式AI编写的项目。作者认为Codeberg有权民主决策,但该政策定义模糊("大部分"难以量化),实际执行可能依赖社区规范而非明确规则。开源社区正因LLM和智能体工具分裂,而Codeberg此举可能削弱其作为GitHub的欧洲替代方案所应具备的广泛性和可靠性。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

Grok 4.5 在真实发票处理中排名第一

xAI 的 Grok 4.5 在 Ramp 对 15 万张真实企业发票的测试中取得最高完美提取率,击败了 Gemini Flash 3.6、GPT 5.6 Terra 和 Sonnet 5 等同等价位模型。该任务要求模型在 10 万+ token 的上下文中推理发票模式与人工修正,实现零点击应付账款处理。Elon Musk 称 Grok 4.5 在真实工作中表现出色。 🔗 阅读原文 via...

noreply@aihot.virxact.com (X:Elon Musk (@elonmusk, xAI))

OpenAI 推出自定义宠物分享功能

秀出你的宠物 【引用 @OpenAIDevs】:你的宠物已准备好与其他开发者见面。 在 ChatGPT 网页版上,为你的自定义宠物创建一个可分享的链接,并发送给朋友领养。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmrzf3a6z00o9ro2i38swr9y5

noreply@aihot.virxact.com (X:Tibo (@thsottiaux))

黄仁勋首条推文:支持开源AI模型

英伟达CEO黄仁勋发布其推特首条推文,公开签署支持开源模型重要性的联名信。信中指出,开源模型能强化安全与网络安全、加速创新与扩散,并支持各国实现AI主权。黄仁勋强调,世界既需要前沿闭源模型,也需要前沿开源模型。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmrzf3my000oxro2i6uln98qz

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

Atomic Agent 在 GAIA 基准测试中击败 Hermes

Atomic Agent 在 GAIA Level 1 基准测试中以 69.8% 的准确率击败 Hermes 的 58.5%,速度快 1.6 倍。两者均使用相同 4-bit Qwen-3.6-35B 模型在 Apple M4 Max 上运行,Atomic 在 3 小时 12 分钟内解决 37/53 个任务,Hermes 耗时 5 小时 10 分钟解决 31/53 个任务。 🔗 阅读原文...

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

GPT-5.6 Sol 在 DeepSWE 基准测试中以 72.7% 领先 Opus 5 的 68.8%

GPT-5.6 Sol 在 DeepSWE 基准测试中取得 72.7% 的成绩,领先于 Claude Opus 5 的 68.8%。DeepSWE 测试模型在陌生代码库中自主完成功能开发或 Bug 修复的能力。 🔗 阅读原文 via AI HOT · https://aihot.virxact.com/items/cmrzf3my000oyro2iqr71dv9a

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

Opus 5 发布:两月性能跃升,ARC-AGI 3 超 30%

Opus 5 在发布仅两个月后,ARC-AGI 3 基准性能从 Opus 4.8 的不足 5% 跃升至超过 30%。据 Artificial Benchmark,Opus 5 智能水平与 Fable 5 相当,但每任务成本低 26%。该模型在多数评测上超越 Fable 5,标志着 AI 能力的快速迭代。 🔗 阅读原文 via AI HOT ·...

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

SmolForge 新增自定义皮肤与动画功能

ok fine 4 new features - SmolForge 现在支持可自定义皮肤和精灵图动画了 🔗 阅读原文:https://x.com/swyx/status/2080750437133901925 via AI HOT · https://aihot.virxact.com/items/cmrze4prh00jfro2inytoed22

noreply@aihot.virxact.com (X:swyx (@swyx))

Gemini 3.6 Flash 多智能体实时迭代游戏设计

👾观看一个基于 Gemini 3.6 Flash 构建的多智能体系统实时迭代可玩游戏设计。它使用 Gemini 3.5 Flash-Lite 根据实时玩家动作设计、构建和验证谜题挑战,在快节奏环境中平衡速度与推理。 🔗 阅读原文:https://x.com/googleaidevs/status/2080749497337184759 via AI HOT ·...

noreply@aihot.virxact.com (X:Google AI for Developers (@googleaidevs))

OpenAI 宠物功能支持分享链接给好友收养

你的宠物已准备好与其他开发者见面。 在 ChatGPT 网页版上,为你的自定义宠物创建一个可分享链接,发送给朋友收养。 🔗 阅读原文:https://x.com/OpenAIDevs/status/2080747505474736162 via AI HOT · https://aihot.virxact.com/items/cmrze28m500f9ro2i2bvg1dom

noreply@aihot.virxact.com (X:OpenAI Developers (@OpenAIDevs))

Opus 5 生成可玩《火箭联盟》克隆版,性能惊人

Opus 5 仅消耗 5x Max 订阅的 27% 算力,就构建出迄今最逼真的《火箭联盟》克隆游戏,包含可反射车身的细节和可玩版本。@LLMJunky 称其在游戏开发和 3D 建模领域"明显领先于世界最佳模型"。源代码和可玩游戏已开源。 🔗 阅读原文:https://x.com/noahzweben/status/2080747022429413436 via AI HOT ·...

noreply@aihot.virxact.com (X:Noah Zweben(@noahzweben))

黄仁勋:知识蒸馏是智能的基础

英伟达CEO黄仁勋在Axios采访中回应"是否应允许开源模型蒸馏闭源模型"时表示,蒸馏是智能的基础,AI必须从其他来源学习。他指出,未来互联网可能99%由AI生成内容,AI系统将不断从其他AI中蒸馏知识,更智能的AI也更安全。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2080746553573245301 via AI HOT ·...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))
上一页 第 298 / 968 页 下一页

添加 Feed

导入 OPML