RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
网易有道发布 Confucius4-TTS:14 语种跨语种无口音语音克隆开源模型
网易有道推出"子曰 4.0"TTS 引擎 Confucius4-TTS,声称是业内首个支持 14 种语言跨语种无口音、且无需参考文本即可完成语音克隆的开源模型。用户仅需 3 秒音频即可实现零样本音色克隆,克隆音色与原声相似度超 85%,任务准确度达 97%。模型支持中文、英语等 14 种语言,首创音频 Prompt 情感克隆迁移。底层采用 GPT 式语义大模型、SSL 预训练特征与...
网易有道发布 Confucius4-TTS:14 语种跨语种无口音语音克隆开源模型
网易有道推出"子曰 4.0"TTS 引擎 Confucius4-TTS,声称是业内首个支持 14 种语言跨语种无口音、且无需参考文本即可完成语音克隆的开源模型。用户仅需 3 秒音频即可实现零样本音色克隆,克隆音色与原声相似度超 85%,任务准确度达 97%。模型支持中文、英语等 14 种语言,首创音频 Prompt 情感克隆迁移。底层采用 GPT 式语义大模型、SSL 预训练特征与...
国内首个高考志愿AI测评出炉,千问多项表现超过资深咨询师
友松实验室发布国内首个高考志愿AI能力测评报告,测试千问高考志愿填报Agent四大模块。与53位平均从业4.6年的人类咨询师对照,千问表现更稳定精确:44道事实题全对;模拟10个志愿中6个可录取;100场匿名对比中专家58次倾向千问回答。使用千问辅助后,人类咨询师正确率提升,耗时减少约27%。该Agent基于千问高考志愿大模型和夸克8年高考数据,覆盖约3000所院校、2000多个专业。 🔗...
国内首个高考志愿AI测评出炉,千问多项表现超过资深咨询师
友松实验室发布国内首个高考志愿AI能力测评报告,测试千问高考志愿填报Agent四大模块。与53位平均从业4.6年的人类咨询师对照,千问表现更稳定精确:44道事实题全对;模拟10个志愿中6个可录取;100场匿名对比中专家58次倾向千问回答。使用千问辅助后,人类咨询师正确率提升,耗时减少约27%。该Agent基于千问高考志愿大模型和夸克8年高考数据,覆盖约3000所院校、2000多个专业。 🔗...
OpenAI正式发布GPT-5.5-Cyber网络安全模型,性能领先
OpenAI推出GPT-5.5-Cyber网络安全模型(取代预览版),在CyberGym(85.6%)、ExploitGym(39.5%)和SEC-bench Pro(69.8%)三项基准测试中领先,超越Anthropic Mythos 5(83.8%)和OpenAI GPT-5.5(81.8%)。同步更新Codex...
Sakana AI 发布 Fugu:0.6B 参数多智能体编排系统,性能超 Claude 和 GPT
日本团队 Sakana AI 推出 Fugu(Fugu Ultra),一个仅 0.6B 参数的多智能体编排系统,通过统一 API 调用。它不是单体大模型,而是 AI"项目经理":简单任务自处理,复杂任务自动拆分,从全球模型池选择模型分配思考、执行、验证角色,多轮协作输出答案。编排策略由训练生成,而非手工 prompt。Fugu Ultra 在多个基准上超过 Claude 和...
字节新一代豆包AI手机或延迟发布,因需双重认证
据蓝鲸新闻6月23日援引知情人士消息,中兴通讯与字节共同推进的新一代豆包AI手机可能延迟,原因是要同时通过网信部门大模型备案和工信部手机终端入网认证。若审批顺利,最快7-8月面世。屏幕供应商从前一代深天马换为京东方,电池采用德赛ATL电芯,预计由福日电子旗下中诺通讯代工。此前双方于2025年12月发售了搭载豆包手机助手技术预览版的工程样机努比亚M153,配备骁龙8至尊版芯片、6.78英寸LT...
英国政府拨款6000万英镑建两所AI实验室,开发低硬件需求开源模型
英国政府6月23日宣布拨款6000万英镑(约5.39亿元人民币),为牛津大学和伦敦大学学院(UCL)建立两座AI实验室。实验室将开发低硬件需求的开源AI模型,减少对美国闭源高算力方案的依赖。AI事务部长Kanishka...
OpenAI DayBreak - GPT-5.5-Cyber
OpenAI 在 DayBreak 活动中发布 GPT-5.5-Cyber 模型,该消息登上 Hacker News 热门,获得 100 个 HN 积分。 🔗 阅读原文:https://openai.com/index/daybreak-securing-the-world
QQ邮箱推出Agently Mail,为AI智能体提供专属邮箱服务
6月23日,腾讯QQ邮箱推出专为AI智能体打造的专属邮箱服务Agently Mail,并开启内测。该产品独立于个人邮箱运行,可为AI Agent提供安全、隔离且具备独立身份的数字通信空间。支持WorkBuddy、QClaw、Marvis、OpenClaw、Claude Code、Kimi...
Gemini Interactions API 正式可用
今天,Interactions API 正式可用,作为 Gemini 模型和智能体的主要接口。该 API 基于开发者反馈构建,针对有状态、智能体的工作流优化,带来 Managed Agents、后台执行、扩展工具支持、多模态生成以及即将推出的 Gemini Omni 等新能力。开发者可通过 `npx skills add google-gemini/gemini-skills...
微信上线高考 AI 志愿助手,可在搜一搜直接语音提问
微信搜一搜今日上线"AI 志愿助手",为考生和家长提供志愿填报参考。用户输入分数、大学名称或志愿相关问题,系统结合合作方"掌上高考"的全国高校多年录取分数、位次、计划等结构化数据,给出冲、稳、保三个梯度的建议。支持继续追问以优化推荐,还可直接语音提问并多轮对话。 🔗 阅读原文:https://www.ithome.com/0/967/613.htm
Gemini视觉能力通过新基准测试
Gemini的视觉能力令人印象深刻地通过了这项测试 ⚫️🐜⚫️ 🔗 阅读原文:https://x.com/fofrAI/status/2069359575711596949
百度开源Unlimited OCR:3B总参数、500M激活,单次前向传播可转录40+页
百度开源Unlimited OCR,专为一次性读取长文档设计。模型总参数量3B,仅激活500M,在OmniDocBench...
OpenAI Bidi 1语音模型将支持实时翻译
OPENAI 🔥: 即将推出的Bidi 1语音模型将能进行实时翻译! 这将解锁大量用例,当它落地到API时可在其上构建。 🔗 阅读原文:https://x.com/testingcatalog/status/2069351216648204757
全球最快 500 台超算中 400 多台采用英伟达技术
据 ISC 高性能大会最新 TOP500 排名,英伟达技术为全球 500 台最快超算中的 400 多台提供支持,占比 81%。其中英伟达 GPU 用于 238 台,网络连接技术用于 376 台(多数依赖 NVIDIA Quantum InfiniBand,其余用以太网)。26 台顶级超算采用英伟达 Grace CPU(增加 8 台),Grace CPU 出货量接近 250...
独立开发者用四款开源工具拼出有记忆性格的数字分身
独立开发者用四款开源工具做出有记忆性格的数字分身,未依赖商业API。通过人格蒸馏将几百条笔记压缩成性格,搭配长期记忆和实时语音框架,延迟从8-20秒降至1秒内。换网红峰哥人格体验更佳,认为人格独特性而非万能温柔才是AI陪伴核心。 🔗 阅读原文:https://x.com/AYi_AInotes/status/2069348092655140977
阿里云KaryaWAN AI挑战赛获胜者揭晓
恭喜,我们宣布KaryaWAN AI挑战赛的获胜者诞生了!创作者们借助阿里云的WAN 2.7重新定义了故事讲述,从电影般的愿景到现实世界的影响力。马来西亚已准备好引领AI驱动的故事讲述。 观看入围选手的视频👇 🔗 https://int.alibabacloud.com/m/1000414756/ #AlibabaCloud #KaryaWANAIChallenge...
Coding Agent 2.0:从个人工具到组织系统
🚀 Coding Agent 2.0:从个人工具到组织系统 ꔷ 沙箱隔离与会话恢复 ꔷ 长期记忆与多渠道访问 ꔷ 防止配额消耗并确保安全 使用 AgentScope Harness 构建生产级智能体。 https://int.alibabacloud.com/m/1000414751/ #AgentScope #CodingAgent #LLMOps #OpenSource...
最近听到了好多workbuddy在中小企业的应用,出乎意料的受欢迎。 这可能是腾讯目前最PMF的AI产品。
最近听到了好多workbuddy在中小企业的应用,出乎意料的受欢迎。 这可能是腾讯目前最PMF的AI产品。 🔗 阅读原文:https://x.com/vista8/status/2069341905343967472
阿里云Coding Agent 2.0:从个人工具到组织系统
🚀 Coding Agent 2.0:从个人工具到组织系统 ꔷ 沙箱隔离与会话恢复 ꔷ 长期记忆与多通道访问 ꔷ 防止配额燃烧并确保安全 使用 AgentScope Harness 构建生产级智能体。 https://int.alibabacloud.com/m/1000414751/ #AgentScope #CodingAgent #LLMOps...
腾讯 QQ 邮箱推出 AI 智能体专属邮箱服务 Agently Mail,开启内测
腾讯 QQ 邮箱推出 Agently Mail,为 AI 智能体提供独立于个人邮箱的专属邮箱地址,已开启内测。开通需实名认证,所有写操作需生成摘要经用户确认后执行,读邮件具备 Prompt 注入防护。Agent 可用该邮箱自主注册第三方平台、接收验证码,并支持企业间 A2A 自动通信(询价、报价、订单对接)。已适配 WorkBuddy、Claude Code、Kimi...
Seedance 2.5 即将发布:多资产输入与更长输出
Emad Mostaque 称即将推出的 Seedance 2.5 模型视觉效果惊人,支持多资产输入和更长输出。他预期 Grok Imagine 将在明年底跟上并实现实时生成同等质量。引用其两年前离开 Stability AI 时的预测:中国实验室大约现在会产出近乎完美的视频。如今看到输出质量已达到可创造任何想象内容的水平,每个像素都将被生成,这蕴含深远影响。 🔗...
实测豆包Seed 2.1 Pro,把我六个真实工作流都稳稳接住了
火山引擎Force大会上发布豆包Seed 2.1 Pro,重点提升Agent、GUI操作和编程能力:OSWorld 78.8接近GPT-5.5的78.7,Terminal Bench 2.1达71.0;多模态视觉理解进步显著(CharXiv-RQ...
Emad Mostaque:中国实验室视频近乎完美
当我几年前离开 Stability AI 时,我预测我们现在会看到中国实验室产出近乎完美的视频。 但看到输出质量达到这样的水平,几乎可以创造任何你能想象的东西,仍然令人惊叹。 🔗 阅读原文:https://x.com/EMostaque/status/2069335924987600914
OpenAI新"bidi"语音模式太疯狂
OpenAI即将推出的"bidi"语音模式听起来太疯狂了! 🔗 阅读原文:https://x.com/kimmonismus/status/2069333245703975055
宇树科技与 GMO AIR 达成合作,G1 人形机器人等产品将登陆日本市场
6 月 19 日,宇树科技与 GMO AI & 机器人商事(GMO AIR)签署合作协议,GMO AIR 成为宇树科技在日本的官方经销商。GMO AIR 将在日本销售 G1、H1 人形机器人及 Go2、B2 四足机器人,并提供通信、云计算、网络安全、金融服务等完整解决方案,还可按需提供研发、验证实验和商业应用方案。GMO AIR 已在东京涩谷设立日本规模最大的物理 AI...
OpenAI 正测试双向语音模型 Bidi 1,支持打断与连续对话
OpenAI 正在测试名为 "Bidi 1" 的双向语音模型。它能在你说话时同时插话并保持收听,可在句子中间来回切换任务,处理打断和停顿的能力更强,还能更好地记忆对话上下文。目前模型仍有连续讲话长度上限,但在测试中可轻松数到 23 而不中断。据推文透露,OpenAI 正为网页版准备 Bidi 1:设置中将新增该语音模型选项,语音气泡颜色从蓝色变为黄色。该模型尚未上线,但预计很快就会推出。...