RSS

  • 宝玉的分享
    https://baoyu.io/feed.xml
    刷新于
  • AIHOT 日报
    https://aihot.virxact.com/feed/daily.xml
    刷新于
  • AIHOT — 全部 AI 动态
    https://aihot.virxact.com/feed/all.xml
    刷新于
  • AIHOT — 精选
    https://aihot.virxact.com/feed.xml
    刷新于

Berry Xia展示用YouMind实现X长文创作与一键发布

Berry Xia演示如何用YouMind完成X长文创作并一键发布:将X、YouTube、播客等素材导入,在右侧对话框确定方向,中间区域修改调整,最后直接发布到X长文。配图可使用内置Skills批量生成。YouMind正进行618促销:新用户订阅Pro(20美元/月)或Max(100美元/月),月付首月5折,年付在省两个月基础上首年再8折。

noreply@aihot.virxact.com (X:Berry Xia (@berryxia))

比人鼻更准:新型电子嗅觉芯片可识别 0.05 克腐败坚果

加州大学伯克利分校团队研发出一款集成16个微型气体传感器阵列的电子嗅觉芯片,每个传感器涂有不同感应膜,接触气体后产生独特电信号,被称为"数字鼻子"。经机器学习训练,芯片能识别7种食品(草莓、蓝莓、香蕉、核桃、榛子、腰果、花生)以及新鲜与腐败的鸡肉、牛奶、鸡蛋。测试中可在沙拉或蛋糕等复杂气味背景中检出仅0.05克核桃。但在多种腐烂食物共存的开放环境中,准确性仍需验证。

noreply@aihot.virxact.com (IT之家(RSS))

Midjourney打造60秒全身扫描,优于MRI

天哪,Midjourney现在构建了一种快速、实惠、可重复的全身体扫描,设计得比MRI更好更便宜,大约60秒完成,体验更像一次水疗。

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

曹操出行宣布全面AI转型,到2030年累计部署10万辆Robotaxi

曹操出行在2026国际汽车及供应链博览会(香港)发布RoboX战略,提出"双十万计划":到2030年累计部署10万辆Robotaxi与10万辆Robovan。公司宣布全面AI转型,已成立AI事业部,并与吉利远程新能源商用车战略合作推进Robovan规模化。2025年总收入202亿元,同比增长37.7%,覆盖国内195城,月活用户4130万。Robotaxi已部署超100辆,完全定制Robot...

noreply@aihot.virxact.com (IT之家(RSS))

面壁智能 MiniCPM-V 4.6 演示工业仪表读取,远超 OCR

面壁智能 MiniCPM-V 4.6 演示工业仪表读取,模型需同时理解指针角度、刻度范围、单位、数字显示、液位比例等视觉信号,输出结构化 JSON(pressure_bar, temp_c, flow_lpm, level_pct)。测试使用合成控制面板,评分标准为...

noreply@aihot.virxact.com (X:面壁智能 OpenBMB (@OpenBMB))

Claude Design 上线首周用户破百万,强化与 Claude Code 双向联动

Anthropic 宣布 Claude Design 上线首周用户突破 100 万。新版重构设计系统导入功能,支持从 GitHub 仓库、设计文件或直接上传素材获取设计系统,自动检测输出是否符合现有组件标准。用户可通过 `/design-sync` 拉取设计系统,完成设计后直接传递给 Claude Code 转化为软件;Claude Code 端也可用 `/design`...

noreply@aihot.virxact.com (IT之家(RSS))

深圳回应"全域投放无人驾驶网约车":相关内容系政策误读夸大

深圳智能网联汽车管理条例修正案将于7月1日起施行。部分网帖将"有序探索全域开放道路测试"误读为"全域开放无人驾驶出租车",实为片面解读。条例规定市政府可选择若干行政区或全市有序探索,关键在"有序探索"。当前智能网联汽车仅限于测试示范,市级层面未出台商业化试点政策。

noreply@aihot.virxact.com (IT之家(RSS))

Gemini 联合负责人 Noam Shazeer 加入 OpenAI

"Attention Is All You Need"论文合著者 Noam Shazeer 离开 Google 加入 OpenAI。他此前担任 Google 工程副总裁,与 Jeff Dean、Oriol Vinyals 共同领导 Gemini 模型。Shazeer 于 2000 年加入 Google,2021 年离职创办 AI 聊天机器人初创公司 Character.AI,2024...

noreply@aihot.virxact.com (The Decoder:AI News(RSS))

Anthropic 阿莫迪谈奥尔特曼:志不同、道不合、信不过、懒得争

Anthropic CEO 达里奥·阿莫迪在6月18日采访中称,与OpenAI CEO萨姆·奥尔特曼的竞争已演变为"冷战",双方愿景不同、互不信任,只能各走各路。他暗示市场与公众将裁决谁正确,并借印度AI峰会上两人未牵手合影的一幕批评峰会混乱。阿莫迪含蓄批评OpenAI在安全标准上的合作诚意,但否认行业"互不信任",以与谷歌DeepMind CEO哈萨比斯的15年合作为例说明仍有可信参与者。

noreply@aihot.virxact.com (IT之家(RSS))

英伟达 ACE Game Agent SDK 进入 Beta 测试,内置 Qwen 3.5 4B 模型并支持 UE5

英伟达在虚幻嘉年华 2026 宣布 NVIDIA ACE Game Agent SDK 进入 Beta 测试。该轻量级 C/C++ 框架内置 Qwen 3.5 4B 模型用于决策、Chatterbox Turbo 350M 用于语音合成,包含 UE5 插件,可在 8GB 显存 GPU 上本地运行。SDK 提供 Agent API、Chat API 和 RAG API。已有 KRAFTON...

noreply@aihot.virxact.com (IT之家(RSS))

科大讯飞 AI 眼镜首销:40克重量、122种语言翻译,4299元

讯飞AI眼镜6月18日在京东首销,定价4299元(部分国补后3369元),重40克,获SGS舒适认证。核心搭载语音同传大模型,支持122种语言翻译,覆盖通话翻译、线上同传、同声传译(8米全向拾音)、面对面翻译(18语种离线)、视觉翻译及附赠App权益等六大场景。还支持实时提词、蓝牙遥控翻页,内置GlassClaw AI助理,可开会自动总结图文纪要。

noreply@aihot.virxact.com (IT之家(RSS))

本地版 Qwen 并不是比 Opus 差,它只是另一种工具

一位小型软件公司创始人基于自身业务和开源项目分享,本地 Qwen 27B/35-A3B 模型在特定场景下有实际价值,使用 RTX 6000 Pro 显卡运行,显卡成本已在头两三个月内收回。但本地模型量化后容易出现无限循环和模型幻觉,无法无人监督使用,作者认为不应过度吹捧替代云端 Opus,而是把它看作另一种工具。

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

Catnip 推出 MaineCoon:实时交互音视频 AI 模型

Catnip 发布 MaineCoon,一款 22B 参数的流式实时交互音频-视觉模型,可在屏幕上呈现活生生的 AI 角色。首帧生成不到 1 秒,推理速度达 47.5 FPS(单张 H100),比现有音视频模型快 7 倍。该模型支持无限时长交互,强调 AI 持续在场而非轮流回复,旨在将被动视频升级为实时 AI 存在感。

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))

Apodex:面向深度研究的自进化重载求解器

Apodex专为解决无现成答案的硬问题设计。可同时派出最多150个子Agent并行探索,总步数超15,000步。在BrowseComp上超越GPT-5.5-pro,在DeepSearchQA上超越Claude-Opus-4.8和Kimi-K2.6。工作流程分深度研究、自我校验、撰写三阶段。内置三层自我验证机制(冲突审查员、事实检查员、草稿审查员)及独立全局验证器。由AgentOS负责调度、路...

noreply@aihot.virxact.com (X:小互 (@xiaohu))

MOSS-TTS-Local-Transformer-v1.5 在 SGLang-Omni 上:原生流式 48 kHz 语音服务

MOSS-TTS-Local-Transformer-v1.5 是一款开源 TTS 模型,支持 48 kHz 立体声、零样本声音克隆、最长 10 分钟长文本合成、时长控制及 31 种语言。其核心采用 Qwen3-4B 骨干与约 2B 参数的 MOSS-Audio-Tokenizer-v2 音频编解码器,通过 12 个 RVQ 码本运行。SGLang-Omni 以三阶段流水线部署该模型。在...

noreply@aihot.virxact.com (LMSYS:Blog(Chatbot Arena 团队))

MOSS-TTS-Local-Transformer-v1.5 在 SGLang-Omni 上:原生流式 48 kHz 语音服务

MOSS-TTS-Local-Transformer-v1.5 是一款开源 TTS 模型,支持 48 kHz 立体声、零样本声音克隆、最长 10 分钟长文本合成、时长控制及 31 种语言。其核心采用 Qwen3-4B 骨干与约 2B 参数的 MOSS-Audio-Tokenizer-v2 音频编解码器,通过 12 个 RVQ 码本运行。SGLang-Omni 以三阶段流水线部署该模型。在...

noreply@aihot.virxact.com (LMSYS:Blog(Chatbot Arena 团队))

英伟达GEAR实验室首次启用AutoResearch,机器人自学完成装显卡等高精度任务

英伟达GEAR实验室联合负责人Jim Fan于6月17日宣布,基于ENPIRE编码智能体框架,首次在物理世界中启用AutoResearch。团队为8个Codex智能体配备机器人、GPU和Token预算,设定目标高效完成任务。机器人自主学会寻找视觉线索、重置场景、练习技能、调整控制堆栈、在线阅读论文等,并通过物理世界API独立完成系扎带、整理钉子、插显卡等高精度任务。Jim...

noreply@aihot.virxact.com (IT之家(RSS))

Vivek Nair:AI让"假研究"更舒适

Vivek Nair的文章(520万阅读)指出,2026年AI让研究变成"看起来像在研究"而非真正研究。算法选论文、AI总结摘要、生成代码,使"SFT型"(监督微调)研究异常舒适,但判断力无法被替代。真正的原创研究是"RL型":从目标出发推理。Vivek开出药方:自己选题、读原文、写下来、盯着失败看。大多数人阅读后继续刷下一条。

noreply@aihot.virxact.com (X:Berry Xia (@berryxia))

Midjourney 成立医疗部门,推出超声波全身扫描舱

Midjourney 宣布成立 Midjourney Medical,进军医疗硬件领域,计划制造基于超声波和水耦合介质的全身扫描舱。该设备无需辐射或强磁场,配备 50 万个微型传感器阵列,60 秒内完成全身层析成像,理论速度比传统 MRI 快近 100 倍。公司还将在旧金山开设 Midjourney Spa,融合扫描、泡澡、桑拿、冷水浴,鼓励像按摩一样轻松完成定期扫描。目标全球部署 5...

noreply@aihot.virxact.com (X:阿易 AI Notes (@AYi_AInotes))

奔驰轴向磁通电机量产落地,首搭跑车 AMG GT 零百加速 2.1 秒

6月18日,奔驰宣布轴向磁通电机在柏林工厂启动大规模量产。生产过程包含98道工序,其中65道为奔驰首次应用、35道全球首创,开发超30项新技术并提交专利申请。装配中"婚礼"环节需在9000牛磁力下将定子固定于磁中心平面,公差小于0.1毫米。全新AMG GT高性能四门跑车为首款量产搭载该电机的纯电车型,零百加速2.1秒,峰值功率860千瓦,峰值扭矩2000牛·米。

noreply@aihot.virxact.com (IT之家(RSS))

Vivek Nair 爆文《How to Be Good at Research?》解读:真正的研究是 RL 型而非 SFT 型

Vivek Nair 文章批评多数人只"逆向工程"研究外表(SFT 型),而非自己选题(RL 型)。AI 信息流(推特、arXiv、群聊)系统性地制造共享想法,让人丧失判断力。他开药方:自己选题、读原文、写下来、盯着失败看。2026 年 AI 让 SFT 更舒适(AI 摘要、AI 设计实验),却削弱判断力锻炼。神经科学证明流畅解释易致假顿悟(2025 年 Nature...

noreply@aihot.virxact.com (X:Berry Xia (@berryxia))

Jason Liu:AI生成标题卡片高品味

我其实很自豪这个标题卡片是AI生成的,但个人觉得它品味还算不错。

noreply@aihot.virxact.com (X:Jason Liu (@jxnlco))

卡兹克推荐10本AI时代必读好书:无一直接谈AI,底层能力决定使用水平

卡兹克分享10本对理解AI极有帮助的书,但无一直接关于AI技术。他强调决定AI使用水平的是底层能力,而非工具技巧。书单包括:凯文·凯利《失控》(1994年,核心概念"涌现"--大量简单个体协作产生复杂智能);维纳《人有人的用处》(1950年控制论之父提出"反馈"是人机协作核心);梅多斯《系统之美》(警惕"舍本逐末"--用AI替代思考导致能力存量流失);罗斯林《事实》(用数据思考避免情绪化决策...

noreply@aihot.virxact.com (X:卡兹克 (@Khazix0918))

Transformer 核心作者 Noam Shazeer 加入 OpenAI

Transformer 核心作者 Noam Shazeer 宣布加入 OpenAI。2021 年他因谷歌拒绝发布其聊天机器人而离职创办 Character.AI;2024 年谷歌以约 27 亿美元技术许可协议将其请回,他担任 Gemini 技术负责人。此次离职后 OpenAI 与 xAI 均参与争抢。Shazeer 是《Attention Is All You Need》主要作者,发明了...

noreply@aihot.virxact.com (IT之家(RSS))

Codex推iOS构建插件:浏览器预览与热重载

OpenAI 的 Codex 新增"Build iOS Apps"插件,可内嵌浏览器运行应用、打开 SwiftUI 预览、热重载编辑,全程无需离开 Codex,告别复制-粘贴-构建-截图的循环。Greg Brockman 称这是构建 iOS 应用更好方式。

noreply@aihot.virxact.com (X:Greg Brockman (@gdb))

swyx 的 Midjourney 医疗产品发布现场笔记

swyx 记录 Midjourney 医疗产品发布,与会者将其比作初代 iPhone 和特斯拉发布。该产品旨在将医学成像质量提升 40-100 倍,实现"扫描器官像称体重"。Midjourney 仅以每年 1000 万美元研发预算支撑这一创新,质疑其他机构的研发效率。今年 MJ 另有 7 个副项目计划发布。Nature 论文及 biohub 播客佐证更好数据驱动更好科学。swyx...

noreply@aihot.virxact.com (X:swyx (@swyx))

阿里开源首个统一科学大模型 LOGOS,仅用 1/56 参数超越微软 NatureLM

6 月 18 日,阿里 ATH-Token Foundry 联合人大高瓴人工智能学院开源首个基于统一"科学语法"的多领域科学生成基础模型 LOGOS。LOGOS-1B 仅用 1B 参数量(1/56)在多个任务上超越微软 NatureLM(8×7B)。模型构建涵盖 7 类模态、共 44.87B tokens 的预训练语料,通过共享词表将蛋白质、小分子等异构对象编码为统一离散 token...

noreply@aihot.virxact.com (IT之家(RSS))

Noam Shazeer出走OpenAI,Gemini前景蒙尘

两年前Google以27亿美元请回的AI传奇人物Noam Shazeer,现已离职加入OpenAI。多位DeepMind内部人士称Noam曾拯救Gemini,甚至有传说他仅修改几行训练代码就使模型质量瞬间跃升。尽管有这般贡献,Gemini的编程能力仍显落后。作者对Gemini的未来感到不确定,希望它能重返昔日辉煌,强调行业需要更多模型选择。

noreply@aihot.virxact.com (X:Yuchen Jin (@Yuchenj_UW))

英国监管机构要求谷歌整改:限期6个月提高搜索算法透明度

英国竞争与市场管理局(CMA)依据2025年数字竞争框架,限期6个月要求谷歌全面整改搜索排名系统。所有自然搜索结果必须基于客观、非歧视的标准,AI概述功能也不得偏袒任何平台。CMA同时要求谷歌建立更透明的内部投诉处理流程,并允许用户将个人搜索数据安全迁移至第三方。谷歌需在3个月内完成数据可移植性架构。谷歌发言人回应称其排名系统已公平透明,但将配合监管。

noreply@aihot.virxact.com (IT之家(RSS))

路透社:Google Gemini 联合负责人 Noam Shazeer 离职加入 OpenAI

路透社消息,Google Gemini 联合负责人 Noam Shazeer 将离开 Google 加入 OpenAI。他是 Transformer 时代最重要的模型构建者之一。Google 曾于 2024 年支付 27 亿美元从 Character.AI 将其与团队带回,并让他负责 Gemini 项目。Shazeer 在推文中表示期待加入 OpenAI,并对 Google...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))
上一页 第 711 / 1059 页 下一页

添加 Feed

导入 OPML