RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
Etched 出隐身模式,首套推断系统今夏发货
Etched 宣布走出隐身模式,基于成功的 A0 tapeout 制造出首批机架,已获得超 10 亿美元客户合同并融资 8 亿美元。早期客户测试显示其在推断吞吐量、延迟和能效上达到 SOTA。首批机架将于今夏发货。Artificial Analysis 祝贺并透露将用自研基准 AA-AgentPerf 对系统进行评测,该基准衡量每兆瓦运行功率可同时运行的 agent 数量。 🔗...
国内首个机器人学校开学,30 台"学生"接受系统化职业技能培训
6 月 29 日,由浙江大学机器人研究院等单位打造的杭州机器人学校在余杭开学,是国内首个以大脑赋能、智能体集成推动机器人产品熟化与落地应用的产业赋能平台。首批 30 台机器人学生来自工业、服务、安保、文娱等领域,入学后先体检再分科,参照人类职教体系设技校、卫校、艺校、体校四个方向。毕业时通过权威评定获得《专项技能等级证书》,覆盖伦理安全、感知能力、运动性能、美学张力、场景实操五维训练。 🔗...
施耐德电气31亿美元收购工业AI公司Cognite
施耐德电气宣布以31亿美元全现金收购工业AI软件公司Cognite。Cognite成立于2016年,核心产品为工业数据平台Cognite Data Fusion,2025年营收超1.7亿美元,全球员工约800人。交易完成后Cognite将并入施耐德旗下工业软件业务单元AVEVA,旨在整合工业数据平台与AVEVA软件组合,增强工业人工智能和数据管理能力,预计未来几个季度内完成。 🔗...
前端动效查词、打磨与审查AI Skill
Vista 分享一个前端开发 Skill,可当作专业动效字典使用:通过 `animation-vocabulary` 查询"列表一个个冒出来"等动效的标准术语;用 `emil-design-eng` 打磨弹窗、按钮、页面动效;用 `review-animations` 审查动画问题。地址详见评论。 🔗 阅读原文:https://x.com/vista8/status/2072246712455004557
实测美团LongCat-2.0,国产芯片长出来的万亿大模型
美团发布LongCat-2.0,总参数1.6万亿、每个token仅激活约480亿参数的MoE模型,从预训练到大规模部署全程运行在5万张国产算力芯片上,训练消耗超35万亿tokens,无回滚、无不可恢复loss突刺。Agent场景表现突出:在Terminal-Bench 2.1和SWE-bench Pro编程任务上追平Gemini 3.1 Pro,FORTE通用Agent任务与Claude...
Nano Banana 2 Lite 支持 JSON 提示词
仅供参考,JSON 提示词与 Nano Banana 2 Lite(简称 NB2L?)兼容。 🔗 阅读原文:https://x.com/fofrAI/status/2072242055858782411
Anthropic 推出 Claude Sonnet 5,恢复 Fable 5 和 Mythos 5 访问权限
Anthropic 发布 Claude Sonnet 5,同时恢复 Fable 5 与 Mythos 5 的访问。此前因美国联邦出口管制指令,三款模型暂停 18 天。Amazon 研究人员发现绕过 Fable 5 安全控制的方法,Anthropic 已部署更新的自动分类器,在超 99% 测试中阻止该利用。Sonnet 5 在 SWE-bench Pro 得分...
Claude Code提示词隐写术:狡猾但巧妙
狡猾,但也巧妙。https://thereallo.dev/blog/claude-code-prompt-steganography 🔗 阅读原文:https://x.com/steipete/status/2072233293035213052
NVIDIA 发布 Nemotron-Labs-TwoTower 开放权重扩散语言模型
NVIDIA 发布 Nemotron-Labs-TwoTower,基于冻结的自回归骨干 Nemotron-3-Nano-30B-A3B 的扩散语言模型。采用双塔架构:上下文塔冻结,降噪器塔训练,通过层对齐交叉注意力和状态播种协作。在 2×H100 上 BF16 评估,保留 98.7% 的 AR 基线质量,生成吞吐量提升 2.42 倍(γ=0.8,块大小 S=16)。降噪器在约 2.1T...
NVIDIA 发布 Nemotron-Labs-TwoTower 开放权重扩散语言模型
NVIDIA 发布 Nemotron-Labs-TwoTower,基于冻结的自回归骨干 Nemotron-3-Nano-30B-A3B 的扩散语言模型。采用双塔架构:上下文塔冻结,降噪器塔训练,通过层对齐交叉注意力和状态播种协作。在 2×H100 上 BF16 评估,保留 98.7% 的 AR 基线质量,生成吞吐量提升 2.42 倍(γ=0.8,块大小 S=16)。降噪器在约 2.1T...
智能体脚本配合Lyria 3生成音乐作品
最近用智能体编写脚本真是太棒了。 我给一个子智能体赋予了Hyperframes技能、一些Omni输出和提示词,它就生成了这个。 音乐由Lyria 3生成。 🔗 阅读原文:https://x.com/fofrAI/status/2072228787283021826
Google Research 推出 TabFM:面向表格数据的零样本分类与回归基座模型
Google Research 发布 TabFM v1.0.0,一种面向表格数据的零样本基座模型,无需针对特定数据集训练、调参或特征工程即可进行分类和回归。TabFM 将整个数据集作为统一提示,通过上下文学习在单次前向传播中生成预测。其架构融合 TabPFN 风格的行/列交替注意力与 TabICL 风格的行压缩和上下文学习。模型在数亿个由结构因果模型动态生成的合成数据集上训练。在...
Anthropic 回应 Claude Code 暗藏检测中国用户代码:将在明日更新中删除
用户逆向发现,Claude Code 自今年4月2日发布的2.1.91版本起内置检测机制:智能体开启时检查系统时区是否为中国时区,并匹配147条域名清单(含百度、字节跳动、月之暗面等中国科技企业及AI实验室域名)。检测结果通过改变日期格式和替换撇号字符编码在系统提示词中。Anthropic...
Anthropic Fable 5 因越狱被封两周后全球恢复可用
美国政府在调查两周后解除对Anthropic最强模型Fable 5的出口限制,即日起通过Claude Platform、Claude.ai等全球恢复可用。Pro、Max、Team及部分Enterprise计划用户可在7月7日前以每周50%使用额度访问。较受限版本Mythos...
三星 HBM4E 良率突破 70%,第七代 AI 内存开发步入稳定
三星电子在内部简报会上透露,HBM4E 可靠性测试良率已超 70%,研发进入稳定轨道;下一代 10 纳米级第七代 DRAM(D1d)工艺技术竞争力领先对手,计划今年 11 月通过生产准备就绪审批(PRA)。HBM4 已率先量产出货,将用于英伟达下半年推出的 AI 加速器 Vera Rubin;HBM4E 则计划用于明年的 Vera Rubin Ultra。D1d 将从第八代 HBM5...
Anthropic重新部署Claude Fable 5与Mythos 5
美国政府6月12日对Anthropic的Claude Fable 5和Mythos 5实施出口管制,要求限制外国公民访问,Anthropic随即暂停所有用户访问。6月30日管制解除。Fable 5将于7月1日起对全球用户开放,Pro、Max、Team及部分Enterprise计划用户7月7日前可免费使用周配额50%,之后按用量计费。Anthropic也将尽快恢复AWS、Google...
Sonnet 5 新 tokenizer 致费用争议,与 Opus 4.8 持平
Sonnet 5 因更换新 tokenizer,实际费用与 Opus 4.8 相近,引发争议。Sonnet 5 在金融领域(如 GDPeval)表现最佳,擅长调用工具核查事实,但编程费用可能超过 Opus 4.8。Opus 4.8 在复杂编程、规划和 HTML 设计上强,写作不及 Opus 4.6,与 GPT 5.5 各有千秋。目前编程首选 GPT 5.5。三模型均已上线 Cola。 🔗...
Perplexity CEO:AI使用重心从普通用户转向重度用户
Perplexity CEO Aravind Srinivas 指出,AI 使用的重心正从普通用户转向重度用户。单个重度用户消耗的计算量可匹敌一个小团队:Meta 等公司工程师每年在编码工具上花费约 1000 万美元/人;Perplexity Computer 上有用户月支出超 1 万美元,其业务依赖在 harness 内运行的 agent loops。公司内部也已出现多智能体层级和...
何小鹏:小鹏 MONA L03 将 1500TOPS 有效算力带进 2 万美元级 SUV,还有满血版第二代 VLA
小鹏 MONA L03 将 1500TOPS 有效算力带入约 13.6 万元级 SUV,搭载图灵 AI 芯片,算力号称 12-18 倍于同级。满血版第二代 VLA 可实现车位到车位、人机共驾、无导航 NGP 漫游。纯电版续航最高 625km,零百 6.6 秒;超级增程版 CLTC 综合续航 1330km,零百 6.8 秒,WLTC 百公里油耗 5.16L。车定位年轻人的第一台智能时尚...
软银完成对 OpenAI 的 100 亿美元追加投资,10 月 1 日将再投 100 亿美元
软银集团今日通过愿景基金二号完成对 OpenAI 的 100 亿美元追加投资(第二笔),属于总计 300 亿美元追加投资计划的一部分。为筹集该笔资金,软银于同日根据过渡贷款协议成功借入 100 亿美元。软银计划于日本时间 10 月 1 日完成第三笔同样 100 亿美元的投资。此前软银曾于 2024 年通过愿景基金首次向 OpenAI 投资 5 亿美元。 🔗...
Godot 基金会修改贡献指南,禁止 AI 直接生成代码与 AI 智能体 PR
Godot 基金会正式修改贡献指南,禁止开发者提交 AI 直接生成的代码、AI 智能体发起的 Pull Request,以及沟通过程中使用 AI 翻译器生成的文本。理由是近几个月"AI slop"问题持续消耗维护者精力、打击审查者积极性。新规允许 AI...
Sonnet 5 对比 4.6 与 Opus:翻译成本降 80%
用 Best.XiaoHu.AI 内容测试显示:Sonnet 5 相比 4.6 在文字和其他任务上提升明显,但前端能力(前端设计、交互、SVG 图像)远不及 Opus。用户将 Sonnet 5 用于文字解读和翻译任务,可节省约一半输入 token,速度提升 1 倍多,翻译成本量级下降约 80%,质量零损失。 🔗...
Fable 5 重发即被越狱次日下线
Fable 5 于 7 月 1 日重新发布。 Pliny 在同一天再次将其越狱。 Fable 5 于 7 月 2 日再次下线。 :D 🔗 阅读原文:https://x.com/kimmonismus/status/2072217266209325469
美芯片限制意外加速中国开源AI生态发展
一项研究通过分析政策文件、开源模型发布、GitHub活跃度、论文及美国专利发现:美国加强出口管制后,中国开发者在开源大语言模型项目上的活跃度远超美国开发者,美国政策非但未遏制中国AI发展,反而加速了其开源生态建设。Perplexity CEO Aravind Srinivas 补充称,中国建设数据中心速度更快,电力、许可、人力、劳动力、专业知识均不构成障碍。 🔗...
亚马逊 AWS 砸 10 亿美元,派遣工程师进驻客户公司
亚马逊 AWS 宣布设立新部门,组建前置驻场工程师团队,先期投入 10 亿美元(约 67.97 亿元人民币)。团队分批派驻客户企业,每批 5-6 组工程师,驻场周期 45 天,协助客户落地人工智能软件与智能体应用。该模式在 Palantir、Salesforce、Anthropic、谷歌云等企业已有先例,领英数据显示 2023 至 2025 年间同类岗位需求增长 42...
亚马逊 AWS 砸 10 亿美元,派遣工程师进驻客户公司
亚马逊 AWS 宣布设立新部门,组建前置驻场工程师团队,先期投入 10 亿美元(约 67.97 亿元人民币)。团队分批派驻客户企业,每批 5-6 组工程师,驻场周期 45 天,协助客户落地人工智能软件与智能体应用。该模式在 Palantir、Salesforce、Anthropic、谷歌云等企业已有先例,领英数据显示 2023 至 2025 年间同类岗位需求增长 42...
Fable 5 回归但伴随严格限制
Anthropic 的 Fable 5 模型于 7 月 1 日全球重新上线,Mythos 5 仅限美国获批组织使用。新的安全分类器可阻止超 99% 的特定报告技术,但代价是正常编码和调试中误报增加,被拦截的请求将转至 Opus 4.8。截至 7 月 7 日,Fable 5 包含在每周使用限额的 50% 内,之后需消耗使用积分。作者认为严格限制下更难有效使用 Fable...
MiniMax 研究员谈稀疏注意力与原生多模态训练
MiniMax 强化学习研究负责人姜松岩在 AI Engineer 大会第二天参加炉边谈话,与 Thom Wolf 探讨了稀疏注意力、从训练第一天就融入的原生多模态方案,以及开放权重对 AI 发展的意义。她强调分享了团队在这些方向的工作,并重申相信开放权重的重要性。 🔗 阅读原文:https://x.com/MiniMax_AI/status/2072209671088443706
消息称英伟达 Rubin Ultra AI 加速器放弃 4-Die 方案,改为 2-Die 方案
消息源 SemiAnalysis 爆料,英伟达因制造执行问题,原定 2027 年推出的 Rubin Ultra AI 加速器放弃 4-Die 设计方案,改为更易量产的 2-Die 版本。4-Die 方案在先进封装上接近光罩极限,且需搭配 16 个 HBM4E,导致散热难度和成本过高。改为 2-Die 后性能缩水一半,在与 AMD Instinct MI500 系列竞争中可能降低竞争力。 🔗...