RSS

  • 宝玉的分享
    https://baoyu.io/feed.xml
    刷新于
  • AIHOT 日报
    https://aihot.virxact.com/feed/daily.xml
    刷新于
  • AIHOT — 全部 AI 动态
    https://aihot.virxact.com/feed/all.xml
    刷新于
  • AIHOT — 精选
    https://aihot.virxact.com/feed.xml
    刷新于

阿里云开源 0.8B 文档解析模型 OvisOCR2,端到端模型首次超越流水线方法登顶 OmniDocBench

阿里云开源发布文档解析模型 OvisOCR2,以 96.58 的综合得分在 OmniDocBench v1.6 上登顶,成为首个超越流水线方法的端到端模型。该模型基于 Qwen3.5-0.8B 后训练得到,采用端到端技术路线,可直接将文档图像输出为 Markdown 格式。项目以 Apache 2.0 许可证开源,兼容 vLLM 等主流推理框架。 🔗...

noreply@aihot.virxact.com (IT之家(RSS))

Black Forest Labs 发布 FLUX 3 多模态模型,支持单次生成 20 秒视频与原生音频

Black Forest Labs 以 Early Access 方式推出 FLUX 3 多模态基础模型,采用统一架构联合学习图像、视频和音频。该模型基于 Self-Flow 学习框架扩展,可在单次生成中输出最长 20 秒视频并附带原生音频,支持文生视频、图生视频、多镜头串联等任务。 🔗 阅读原文:https://www.ithome.com/0/981/137.htm via AI...

noreply@aihot.virxact.com (IT之家(RSS))

Black Forest Labs 发布 FLUX 3 多模态模型,支持单次生成 20 秒视频与原生音频

Black Forest Labs 以 Early Access 方式推出 FLUX 3 多模态基础模型,采用统一架构联合学习图像、视频和音频。该模型基于 Self-Flow 学习框架扩展,可在单次生成中输出最长 20 秒视频并附带原生音频,支持文生视频、图生视频、多镜头串联等任务。 🔗 阅读原文:https://www.ithome.com/0/981/137.htm via AI...

noreply@aihot.virxact.com (IT之家(RSS))

ChatGPT Work 或更名 Vibe 引热议

我们是否应该把 ChatGPT Work 改名为 ChatGPT Vibe? 🔗 阅读原文:https://x.com/thsottiaux/status/2080543574211666029 via AI HOT · https://aihot.virxact.com/items/cmryl2psr02blrolgb4qtn344

noreply@aihot.virxact.com (X:Tibo (@thsottiaux))

Claude Opus 5 即将发布,部分用户已可用

尽管我们昨天都期待 Opus 5,但看来所有对 4.8 版本的请求仍被路由到新版本 5。 所以发布应该仍然迫在眉睫。Polymarket 仍给出今天发布的 22% 概率 ;) 🔗 阅读原文:https://x.com/kimmonismus/status/2080543147038306792 via AI HOT ·...

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

小鹏人形机器人开启小批量试生产,量产产线进入最后联调阶段

小鹏人形机器人在广州工厂正式开启小批量试生产,量产产线进入最后联调阶段。小鹏计划2026年实现人形机器人量产,预计2027年起陆续进驻全球小鹏门店及商业场景,承担导购、讲解等服务。机器人业务整合了集团硬件、AI大模型、供应链及营销等模块能力,并复用汽车业务的软硬件协同研发与智能制造经验。 🔗 阅读原文:https://www.ithome.com/0/981/130.htm via AI...

noreply@aihot.virxact.com (IT之家(RSS))

Codex CLI 是否支持GPT语音功能

Codex CLI 支持 GPT live 语音吗 如果支持是不是可玩性更高? 🔗 阅读原文:https://x.com/xiaohu/status/2080542534439481647 via AI HOT · https://aihot.virxact.com/items/cmryl3tp302cmrolgwll8vsod

noreply@aihot.virxact.com (X:小互 (@xiaohu))

月之暗面 Kimi K3 模型 AI 智能体知识工作跑分超 GPT-5.6 Sol,仅次于 Claude Fable 5

月之暗面 Kimi K3 模型在 AA-Briefcase 基准测试中获 1543 分,超过 GPT-5.6 Sol(1501 分),仅次于 Claude Fable 5(1574 分)。该模型拥有 2.8 万亿参数和 100 万 Tokens 上下文窗口,输入费用每百万 Tokens 缓存命中 2 元、未命中 20 元,输出费用 100 元。 🔗...

noreply@aihot.virxact.com (IT之家(RSS))

腾讯混元大语言模型与多模态团队合并,成立基础模型部由姚顺雨统一管理

腾讯宣布混元多模态模型部门与大语言模型部门合并,成立基础模型部,由首席AI科学家姚顺雨统一管理。7月上线的Hy3大语言模型智能水平比肩参数规模2-5倍的旗舰模型,发布一周后总调用量较上一代Hy2增长超68倍。混元3D世界模型2.0(Hy World 2.0)已开源,支持文字、图片、视频输入生成3D世界,社区下载量超300万。 🔗...

noreply@aihot.virxact.com (IT之家(RSS))

Ling-3.0-flash 在 OpenCode 免费开放调用

Ling-3.0-flash 在 OpenCode 免费调用了~ 🔗 阅读原文:https://x.com/berryxia/status/2080537339290689814 via AI HOT · https://aihot.virxact.com/items/cmrykzzfh0296rolg6c23ur1i

noreply@aihot.virxact.com (X:Berry Xia (@berryxia))

Tibo 团队招募:科幻变现实技术岗

从科幻到科学现实。如果你想参与一些最酷、最具影响力的技术工作,请加入团队。 🔗 阅读原文:https://x.com/thsottiaux/status/2080537149204758689 via AI HOT · https://aihot.virxact.com/items/cmryk03ya01x7rolg9l2sah3t

noreply@aihot.virxact.com (X:Tibo (@thsottiaux))

Stripe 拟百亿美元收购 OpenRouter

据 WSJ 报道,Stripe 正与 OpenRouter 谈判约 100 亿美元收购。OpenRouter 数天前刚以 13 亿美元估值完成 1.13 亿美元融资。Stripe 已为其处理支付,收购后将把计费与 AI 分发结合,获得跨模型提供商的使用数据与定价影响力。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2080536782765015154...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

Black Forest Labs 发布多模态模型 FLUX 3

Black Forest Labs 推出了 FLUX 3,这是一个用于图像、视频、音频和动作预测的多模态模型。 > 在一个统一架构中联合训练,我们的模型可扩展用于预测机器人动作。 > FLUX 3 Video 现已开放早期访问(需通过表单申请)。 🔗 阅读原文:https://x.com/testingcatalog/status/2080536654423478676 via AI...

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))

何小鹏:目标2027年下半年广州Robotaxi业务实现单车盈亏平衡

小鹏CEO何小鹏预计,广州Robotaxi业务最早可在2027年下半年实现单车盈亏平衡,关键取决于特定运营区域的车辆密度而非车队总规模。小鹏计划明年推出更适合Robotaxi的车型,并作为全栈软硬件解决方案提供商向各地合作伙伴输出技术、AI和车辆,而非自行运营车队。目前小鹏正与数十家潜在合作伙伴洽谈,其中超一半来自海外,未来大部分Robotaxi业务预计将分布在中国以外市场。 🔗...

noreply@aihot.virxact.com (IT之家(RSS))

消息称台积电版特斯拉 AI5 芯片采用 3nm 工艺制程

特斯拉 AI5 世代芯片采用双源化供应策略,台积电版基于 3nm 节点,设计合作伙伴为创意电子 (GUC),流片进度较三星晶圆代工版本早一个季度。三星晶圆代工版 AI5 则基于 2nm GAA 工艺,已完成流片,但制造成本更高。两版本因晶体管架构不同(FinFET vs GAA),在芯片设计物理实现层面存在不小差异。 🔗...

noreply@aihot.virxact.com (IT之家(RSS))

Google 推出"自拍视频"登录功能,用于账户恢复与二次验证

Google 为 Google 账户新增"自拍视频"登录方式,用户可通过录制面部视频并完成简单头部动作来设置或验证身份。该功能主要用于账户锁定或无法使用常用设备时的恢复登录,视频经加密存储且用户可随时删除。Google 通过多层安全机制(包括活体检测与深度伪造防御)防止冒充。 🔗...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

Claude Code 整合 Rust 重构版 Bun,Linux 启动快 10%

6 月 17 日发布的 Claude Code v2.1.181 已整合 Rust 语言重构的 Bun,在 Linux 平台上启动速度快 10%。Bun 是执行 JavaScript 和 TypeScript 的 Runtime,此前开发者耗时 11 天、耗费 16.5 万美元将其从 Zig 重写为 Rust。 🔗...

noreply@aihot.virxact.com (IT之家(RSS))

Higgsfield 超级计算机让 Claude 直接操作 After Effects 实时项目

Higgsfield 新推出的超级计算机使 Claude 能直接读取并修改 Adobe After Effects 的实时项目,包括图层、关键帧、效果和表达式。用户只需描述任务,Claude 即可自动编写 ExtendScript 或使用表达式生成可手动编辑的标准场景。所有操作均可通过 Higgsfield MCP 在 Claude 中直接执行。 🔗...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

AMD 携手 Cerebras 押注低时延 AI 推理:每瓦每秒 Token 吞吐提升 5 倍

AMD 在 Advancing AI 2026 活动中宣布与 Cerebras 合作,联合开发针对超低延迟 AI 推理的解决方案。该方案整合 AMD 的 Helios 机架与 Cerebras 的 Wafer-Scale Engine,分别处理提示词与 Token 生成环节,预估可将每瓦每秒 token 数量提高 5 倍。 🔗...

noreply@aihot.virxact.com (IT之家(RSS))

梁文锋:CUDA护城河一年内崩塌

DeepSeek梁文锋在投资人会议中判断,英伟达CUDA护城河正快速瓦解。AI写代码配合自研TileLang高级语言,几个月即可复刻CUDA十几年积累的算子生态。华为950超节点已能全任务平替GB300,他放话一年内扭转"国产卡不好用"的认知,唯一瓶颈是产能而非技术。 🔗 阅读原文:https://x.com/AYi_AInotes/status/2080527764617125911...

noreply@aihot.virxact.com (X:阿易 AI Notes (@AYi_AInotes))

美国网友报修宽带故障陷 AT&T AI 助手 Andi 死循环:对话超 1 小时未登记或转人工

网友 u/SnooPeripherals2206 在 Reddit 发帖称,家中光纤线路被狗咬断后联系 AT&T 客服,其 AI 助手 Andi 在持续超 1 小时的对话中未能有效登记报修内容,也未完成人工转接。该网友形容整个过程为"死亡循环"(death loop),AI 仅回复套话,未实质推进问题解决。 🔗...

noreply@aihot.virxact.com (IT之家(RSS))

黄仁勋谈AI蒸馏:学习是智能的基础

英伟达CEO黄仁勋在Axios采访中回应"是否应允许开源模型蒸馏闭源模型"时表示,蒸馏(从其他AI学习)是智能的基础。他指出,未来几年互联网内容可能99%由AI生成,AI系统将不断从其他AI中蒸馏知识与智能。他认为AI能够学习是好事,更智能的AI也更安全。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2080526596847587839 via AI...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

ChatGPT 桌面版语音功能上线

在桌面应用中尝试 ChatGPT 语音功能: 🔗 阅读原文:https://x.com/gdb/status/2080524965514723414 via AI HOT · https://aihot.virxact.com/items/cmryiz4mf01pkrolghsnqhf0j

noreply@aihot.virxact.com (X:Greg Brockman (@gdb))

阿里云桌面智能体集成TinyFish Mako执行引擎

阿里云桌面智能体集成TinyFish的Mako执行引擎,引入一个专为复杂多步骤任务设计的、基于Web原生工作流训练的智能层。该引擎并非通用大语言模型的简单封装,而是针对实时企业工作流训练,能减少卡顿、降低延迟,实现端到端任务完成。 🔗 阅读原文:https://x.com/alibaba_cloud/status/2080524781997408385 via AI HOT ·...

noreply@aihot.virxact.com (X:阿里云 / Alibaba Cloud (@alibaba_cloud))

Genspark 发布 GenTeam 人机协作工作空间

Genspark 推出 GenTeam,一个让人类团队与 AI 智能体并肩工作的共享工作空间。用户可一键从市场部署营销、编程、设计等专业智能体,或创建自定义智能体,所有智能体均运行前沿模型并支持 24/7 工作。GenTeam 支持私聊、群组协作及权限控制,旨在替代独立聊天会话,实现持久化人机协作。 🔗...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

用百度 Unlimited-OCR 构建端到端高分辨率图像与多页 PDF 解析管线

本教程构建了一套完整的 OCR 工作流,在 GPU 上加载百度 3B 参数的 Unlimited-OCR 视觉语言模型,支持 bfloat16/float16 自动选择。管线包含两种推理模式:Gundam 模式(分块高细节)和 Base 模式(单视图更快),并通过 PyMuPDF 和 infer_multi() 扩展至多页 PDF 解析,全程保留长上下文生成、重复控制和结构化输出设置。 🔗...

noreply@aihot.virxact.com (MarkTechPost(RSS))

以前玩游戏时间长了点有负罪感,觉得虚度光阴了,现在一边玩游戏一边等 Agent 干活,居然有点心安理得。 可能从砍柴变成了放羊?

以前玩游戏时间长了点有负罪感,觉得虚度光阴了,现在一边玩游戏一边等 Agent 干活,居然有点心安理得。 可能从砍柴变成了放羊? 🔗 阅读原文:https://x.com/dotey/status/2080519708189560839 via AI HOT · https://aihot.virxact.com/items/cmryhv3ws01ayrolgrm9n8iu4

noreply@aihot.virxact.com (X:宝玉 (@dotey))

ChatGPT Voice 因配置错误延迟上线

happens! life imitates art… 【引用 @guinnesschen】:ChatGPT Voice 已全面上线。对延迟深表歉意。我们把"功能开关完全配置错误"写进了发布视频当玩笑。结果一个完全配置错误的功能开关真的延迟了上线。我们意外拍了一部纪录片。 🔗 阅读原文:https://x.com/jxnlco/status/2080517341616484469 via...

noreply@aihot.virxact.com (X:Jason Liu (@jxnlco))

GPT-5.6 Pro 是当前最聪明模型,但命名混乱

Ethan Mollick 认为仅通过聊天机器人可用的 GPT-5.6 Pro 是目前最聪明的模型,而 Codex 中的 GPT-5.6 Ultra 在困难任务上表现较弱。 🔗 阅读原文:https://x.com/emollick/status/2080515937803886872 via AI HOT ·...

noreply@aihot.virxact.com (X:Ethan Mollick (@emollick))

Ling-3.0-flash 在 OpenCode 免费开放

Ling-3.0-flash 现已在 OpenCode 免费使用 inclusionAI 的最新模型针对 token 效率进行了优化 🔗 阅读原文:https://x.com/opencode/status/2080514062262104474 via AI HOT · https://aihot.virxact.com/items/cmrygtxbq0132rolgzddvpeti

noreply@aihot.virxact.com (X:opencode (@opencode))
上一页 第 317 / 979 页 下一页

添加 Feed

导入 OPML