RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
A社封号邮件含追踪器遭用户怒斥
用户@juransir 因账号被封后爆料,称A社(未具名AI公司)在通知邮件中嵌入追踪器,可监控用户打开邮件时的地理位置。该用户表示,此前因账号存活而隐忍未发,封号后终于公开指责A社"心术不正",并预言其终将遭报应。主推文@归藏 转引此帖,感叹"这么离谱"。事件未涉及具体模型版本、技术参数或价格数字,核心争议集中在AI厂商对用户隐私的潜在侵犯与封号沟通方式的争议。 🔗...
Deepseek发布DSpark推理框架,AI响应速度最高提升85%
Deepseek推出DSpark推理框架,采用推测解码技术,由小模型生成候选答案、大模型批量验证,并一次生成多个token而非单个,使每用户响应速度提升60-85%。系统基于置信度动态调整验证深度,减少无效计算。DSpark与Deepseek-V4-Pro模型(与北京大学联合开发)已在HuggingFace和GitHub以MIT许可证开源。高效推理降低对高端芯片需求,有助于中国与欧盟在芯片受...
音乐流媒体平台 Tidal 公布人工智能政策:AI 生成作品无法收益化
6月30日,Tidal公布AI政策:接受AI生成音乐但需标记,且无法获得直接商业收益。平台不容忍利用真人信誉欺骗听众或降低服务质量的GenAI内容。Tidal承认当前处于GenAI音乐时代开端,获授权AI版税分配仍有争议,但首要任务是确保版税归于人类直接创作、谱写、演奏的原创作品,因此将AI生成作品排除在收益化范围之外。 🔗 阅读原文:https://www.ithome.com/0/970/599.htm
Anthropic封杀浙江杭州IP,阿里涉大规模蒸馏Claude
Anthropic 封杀所有浙江和杭州 IP 的 Claude 访问,可能与上周指责阿里利用 25000+ 账号大规模蒸馏 Claude 数据有关。从 4 月 22 日到 6 月 5 日,交互次数超过 2880 万次。封杀邮件还内置追踪器,点开即确认用户位置,申诉也无法解封。 🔗 阅读原文:https://x.com/xiaohu/status/2071873045036433547
小米澎湃 OS 3 升级:新增 2026 世界杯赛程小部件,相册 AI 修图工具整合
小米澎湃 OS 3 今日官宣升级。足球赛事方面:超级小爱新增赛事预约与问答(需 7.12 及以上,数据由中国移动灵犀提供);小米超级岛可常驻显示小红书(≥9.34.0)、直播吧(≥7.2.1)赛事比分;桌面新增 2026 世界杯赛程小部件(数据来自腾讯体育)。相册 AI 修图专区聚合全部 AI...
花旗研究:中国模型token价格低至18美分,企业转向成本控制引AI定价压力
花旗研究数据显示,中国模型每百万token收费低至18美分,而顶级模型均价4美元。OpenRouter上开源模型处理占比从1月34%升至6月65%,DeepSeek等中国模型因低价受关注。Gartner预测AI编码成本2028年将超普通开发者薪资。按用量付费使企业从"选最强模型"转向成本控制,OpenAI和Anthropic面临逐任务比价压力。前Meta PM及Perplexity...
Meta AI 发布 Brain2Qwerty v2:非侵入式 MEG 脑到文本解码管线
Meta AI 近日发布 Brain2Qwerty v2,一种基于非侵入式脑磁图(MEG)信号的实时脑到文本解码管线,无需植入或手术。系统在 9 名志愿者约 22,000 句打字数据上训练(每人 10 小时),平均词准确率 61%(WER 39%),最高参与者达 78%,超过半数句子错误不超过一个词。管线由卷积编码器、Transformer...
TrendForce:AI需求排挤产能,晶圆代工成熟制程涨价预计延伸至2027年
AI Server、General Purpose Server与Edge AI需求升温,晶圆代工产能向AI倾斜。八英寸制程受惠于Power订单增量及台积电、三星减产,产能利用率与代工价格强势拉升。十二英寸成熟制程因台积电减产、Power...
Moondream Photon 通过流水线解码消除 GPU 气泡,提升 35% 吞吐量
Moondream 推理引擎 Photon 在 NVIDIA B200 上实现约 33ms 近实时 VLM 推理。其利用流水线解码技术,将 GPU 计算与 CPU 任务重叠,消除传统循环中 GPU 空闲等待的"GPU 气泡",使解码吞吐量提升高达 35%。文章详述三种关键机制:乒乓缓存槽位避免缓冲冲突、前向计算与采样解耦实现受约束解码、以及已结束请求的清理流程(zombies)。 🔗...
Anthropic疑似为Fable 5设独立信用系统并绑定身份验证
Anthropic的Claude应用新字符串显示,Fable 5将被置于独立使用信用(usage-credit)系统中,在现有套餐之外单独计费,且需完成身份验证后才能添加信用。此前Anthropic称身份验证与Fable无关,仅限被标记账户,但这些新字符串与Fable 5信用变动一同出现,可能意味着政策收紧。 🔗...
戛纳国际创意节首设AI Craft子赛道,可灵AI参与作品获奖
本届戛纳国际创意节首次设立"AI Craft"子赛道。可灵AI参与制作的两部广告获奖:《L'Ultimo Uomo Reale》获Classic单元Film银奖及Craft单元Film Craft铜奖;《Lorem Ipsum》获Classic单元Film铜奖。这标志着AI创作正式进入全球最高级别广告创意奖评审体系。 🔗...
中国太阳能发电规模揭示AI算力的物理瓶颈
推文展示贵州山区绵延至地平线的太阳能板群,将裸露岩体转化为太瓦时量级的电力。引用观点指出,AI规模化发展受制于电力、矿产与磁铁供应链等物理输入,而中国在电力冗余以及数据中心与芯片依赖的关键矿物和磁材供应链上拥有主导优势。这一基础设施差距正成为AI竞争的核心变量。 🔗 阅读原文:https://x.com/rohanpaul_ai/status/2071865822805446943
黑石未来3~5年拟投300亿美元在日本建AI数据中心,联合成立AI XPV平台
黑石计划未来3~5年在日本AI数据中心领域投资300亿美元,此前的500MW基础上新增超1GW容量。黑石总裁认为AI投资仍处早期,真正风险是算力短缺而非基建泡沫;谷歌、亚马逊是英伟达潜在挑战者。此外,黑石、阿波罗、博通本月9日成立AI...
黑石未来3~5年拟投300亿美元在日本建AI数据中心,联合成立AI XPV平台
黑石计划未来3~5年在日本AI数据中心领域投资300亿美元,此前的500MW基础上新增超1GW容量。黑石总裁认为AI投资仍处早期,真正风险是算力短缺而非基建泡沫;谷歌、亚马逊是英伟达潜在挑战者。此外,黑石、阿波罗、博通本月9日成立AI...
美团发布LongCat-2.0,1.6T参数MoE模型,支持1M上下文窗口
美团推出LongCat-2.0,总参数1.6T(MoE架构,活跃参数约48B),支持1M上下文窗口。训练与部署完全基于AI ASIC超算集群,已以Owl Alpha名称在OpenRouter上线测试。模型专为智能体编码设计:LongCat Sparse Attention(LSA)高效处理百万级token;Zero-Compute...
美团发布LongCat-2.0,1.6T参数MoE模型,支持1M上下文窗口
美团推出LongCat-2.0,总参数1.6T(MoE架构,活跃参数约48B),支持1M上下文窗口。训练与部署完全基于AI ASIC超算集群,已以Owl Alpha名称在OpenRouter上线测试。模型专为智能体编码设计:LongCat Sparse Attention(LSA)高效处理百万级token;Zero-Compute...
OpenAI 艺术资助计划设想
如果 OpenAI 有一个艺术资助项目,那会是什么样子? 🔗 阅读原文:https://x.com/jxnlco/status/2071864470436303041
科学家发现液态水中两种结构的分子级证据
一项6月25日发表于《自然·物理学》的研究,通过分子动力学模拟和无监督深度学习,为液态水的"二态模型"提供了分子级证据。研究使用自动编码器分析水分子局部构型,在不预设条件下识别出两种微观结构:密度更高、更无序的结构A与密度更低、更有序的结构B。两种结构在宽温压范围内(包括近室温)均存在。该结果支持水在深过冷区存在液-液相变和第二临界点的假说,有助于解释水在4°C密度最大等反常现象。 🔗...
Perplexity CEO 及分析师:中国数据中心建设快,美国 AI 面临最坏情境
前 Meta PM 转引 Perplexity CEO Aravind Srinivas 称,中国建数据中心速度远快于美国,电力、许可、人力、专业能力均无问题。分析师 @quxiaoyin 进一步指出美国 AI 最坏情境:1)中国开源模型持续抢占市场份额,中国主导模型层;2)模型在华为芯片上训练和推理优化,而非...
LongCat-2.0 开源:1.6T 总参数、48B 活跃参数的 MoE 模型
LongCat-2.0 正式开源,总参数 1.6 万亿,每 token 激活约 480 亿参数,采用 MoE 架构。新引入 LongCat Sparse Attention(LSA)和 N-gram Embedding 模块,支持百万级上下文窗口。模型在 5 万+ AI ASIC 上训练,消耗超 35 万亿 tokens,训练全程无回滚。在编码和智能体任务上表现优异,深度集成 Claude...
X 官方推出托管 MCP,支持 Grok、Cursor、Claude 等工具零部署调用 X API
X 官方推出托管 MCP,使 Grok、Cursor、Claude 等 MCP 兼容 AI 工具无需部署即可直接调用 X API,获取搜索、时间线、书签、发文等实时数据,全程走用户权限。该服务并非免费,采用 X Developer App 按量计费模式,读帖和发帖各有单价,重度 Agent 使用容易导致账单失控;写操作限流比读操作更严格,易触发 429...
AI 编程工具 Cursor 推出移动端应用,手机即可操控智能体
Cursor 本周一推出移动端应用 Cursor Mobile,用户可通过手机新建编程智能体,或对接电脑客户端已启动的智能体。该应用与去年 10 月发布的 Cursor 2.0 更新衔接,后者推动服务向独立代码生成智能体转型。此前,Anthropic 与 OpenAI 均已推出同类移动应用。Claude Code 业务负责人鲍里斯·切尔尼表示,自己目前大部分编码工作已在手机上完成。 🔗...
腾讯开源ARGUS:万卡GPU集群监控方案
腾讯团队开源ARGUS方案,用于管理和监控超10,000块GPU的集群。大模型训练成本极高,万卡集群每天电费和折旧达数十万元。ARGUS解决的核心问题是在集群出问题时几分钟内定位原因。论文发现:万卡规模下,超70%训练中断由网络通信问题导致,而非GPU故障。ARGUS通过采集每GPU实时数据(计算负载、显存、网络带宽、通信延迟)进行关联分析,精准定位故障GPU或链路。 🔗...
中国策略:降智能成本至能源成本,输出超美
中国的策略非常简单。 将智能成本降至能源成本 输出超过美国 巨型训练集群的专注是一个巨大的干扰 🔗 阅读原文:https://x.com/EMostaque/status/2071849429506666968
Omdia:2026年近眼显示市场回暖,AR眼镜出货量预计暴增154%
Omdia报告显示,2026年全球近眼显示市场营收预计达6.75亿美元(约45.93亿元),同比增长12%;出货量1453万台,同比增16%。AR显示产品出货量410万台,暴增154%,营收1.56亿美元(约10.61亿元),涨152%,主要由RayNeo、阿里巴巴、XREAL、VITURE等新品驱动。VR头显出货量下滑至1050万台,同比降4%,营收5.187亿美元降4%。Meta、苹果、...
Cline 推订阅计划,折扣访问 GLM-5.2 等开源模型
我们对 GLM-5.2 印象深刻,因此推出每月 $9.99 的订阅,让你能以 2-5 倍折扣访问它以及其他开源权重模型,如 DeepSeek、Kimi、MiniMax、Mimo、Qwen。可通过 Cline CLI 和 IDE 使用,通过 `npm i -g cline` 注册可享受 $1.99 特价促销。 🔗...
OODA循环:AI竞争的核心是迭代速度
推文引用摩根大通CEO杰米·戴蒙的说法,他曾用OODA循环(观察-定向-决策-行动)评估复杂业务场景。该模型由美国空军上校约翰·博伊德在1970年代初提出,用于解释空战中如何快速做出正确判断。作者认为,未来大模型或AI组织的竞争本质也是如此--谁自我迭代循环得更快,谁就能赢得优势。 🔗 阅读原文:https://x.com/vista8/status/2071847883419312282
特斯拉Cybercab量产版在奥斯汀启动公开道路工程测试
2026年6月30日,特斯拉在奥斯汀公共道路启动首批量产版Cybercab工程测试。车辆无方向盘与脚踏板,配有安全监督员,马斯克发布实拍视频。从2024年10月概念车首秀到实车上路约20个月。目前不对外开放乘客,投入34台Cybercab在市中心验证硬件可靠性。Cybercab为双座车型,完全围绕无人驾驶打造,无后期改装。此前奥斯汀已有无安全员Model...
特斯拉Cybercab量产版在奥斯汀启动公开道路工程测试
2026年6月30日,特斯拉在奥斯汀公共道路启动首批量产版Cybercab工程测试。车辆无方向盘与脚踏板,配有安全监督员,马斯克发布实拍视频。从2024年10月概念车首秀到实车上路约20个月。目前不对外开放乘客,投入34台Cybercab在市中心验证硬件可靠性。Cybercab为双座车型,完全围绕无人驾驶打造,无后期改装。此前奥斯汀已有无安全员Model...