RSS
-
宝玉的分享https://baoyu.io/feed.xml
-
AIHOT 日报https://aihot.virxact.com/feed/daily.xml
-
AIHOT — 全部 AI 动态https://aihot.virxact.com/feed/all.xml
-
AIHOT — 精选https://aihot.virxact.com/feed.xml
Grok模型上线Databricks Agent Bricks
Grok 模型现已可在 Databricks Agent Bricks 上使用。 将 SpaceXAI 的最新模型引入您的企业数据,以驱动强大的 AI 智能体。 https://x.ai/news/grok-databricks
Claude设计+Replit构建工作流
在Claude中设计,在Replit中构建。https://x.com/i/broadcasts/1rGmqqgkEMLGy
Transformer 在5小时故事后记住新密码
你能在听完五个小时的故事后记住一个新密码吗? Transformer 可以。 AI 研究员 Subutai Ahmad 和 Nicolò Fusi 与微软 CVP Doug Burger 一起探讨人类记忆与机器智能之间的根本差异。https://msft.it/6016vllRa
亚马逊员工因支持数据中心限制面临解雇风险
三名亚马逊软件工程师于6月10日被叫入员工关系面谈,公司正调查他们,可能采取包括解雇在内的纪律处分。此前他们本月初在西雅图市议会就数据中心监管作证,并引用该市禁止因政治言论歧视雇员的法规。三人已向民权办公室投诉,指控亚马逊违反该法律。西雅图市议会刚通过一项为期一年的大型数据中心暂停令。
Dean Ball将加入OpenAI领导前沿AI政策团队
Dean Ball宣布,他将于7月6日加入OpenAI,领导名为Strategic Futures的新团队,负责帮助公司制定前沿AI政策。Noam Brown表示,没有比他更合适的人选来协助塑造前沿AI政策,并期待与他合作。
计算机视觉货架跟踪推动零售业生产力提升
计算机视觉自动跟踪货架正帮助零售商应对利润侵蚀。行业低效消耗6.4%总销售额,2026年损失将达1964亿美元(同比增21%),远超3%的销售增速。九成零售商面临管理困难,全面部署商店智能平台的企业占60%(同比升18个百分点);年收入超50亿美元的公司中73%已规模化部署,低于10亿美元的仅42%。BJ's Wholesale...
GLM-5.2 多平台免费使用 6 小时
GLM-5.2 在 Hugging Face Inference Providers 上通过 Zai、Together AI、Novita、Fireworks、DeepInfra 免费提供,持续 6 小时 可搭配 Pi、opencode、Codex、Claude Code 或任何编码智能体进行设置。
OpenAI 发布 LifeSciBench 生命科学基准
OpenAI 推出 LifeSciBench,用于衡量 AI 支持真实世界生命科学研究的能力。该基准与 173 位生物技术与制药科学家共同开发,包含 750 个专家编写任务,覆盖七种生物研究流程。DAIR.AI 的 Elvis Saravia 推荐阅读,并指出通用模型在处理复杂结构时仍然失败,而面向科学研究的专用模型表现显著更优。
General Intuition 洽谈约3亿美元融资,估值超20亿美元
从游戏剪辑平台Medal剥离的AI初创公司General Intuition正洽谈约3亿美元融资,估值超20亿美元。本轮距其1.34亿美元种子轮仅8个月,投资方包括Jeff Bezos、Eric Schmidt及现有投资者Khosla Ventures、General...
Codex 前置 Review 三层级与因果 AI 四代演进:Aether AI 融资信号
用 Codex 写代码时,将 Review 前置可显著降低返工率。作者总结三个层级:零成本版(粘贴提示要求先复述任务再执行)、官方内置版(/plan 或 Shift+Tab 触发计划)、持久化版(AGENTS.md 写入前置规则)。UCSD 黄碧薇教授深耕因果 AI 12 年,提出 AI 四代演进:相关性小模型→因果小模型→相关性大模型(LLM)→因果大模型。其团队开发的...
科技工作者支持的超级 PAC Guardrails Alliance 成立,瞄准 AI 立法
新超级政治行动委员会 Guardrails Alliance 周四由民主党活动人士 Shaunna Thomas 和 Leah Hunt-Hendrix 发起,获科技员工、工会等支持。该 PAC 现有约 500 万美元,计划本周期募资 1500 万,而对手 Leading the Future 获 OpenAI 总裁 Greg Brockman 等支持,资金超 1...
微软评估多款开源模型用于Copilot Cowork,考虑托管DeepSeek V4
微软正评估GLM、MiniMax、Kimi等多款开源模型用于Copilot Cowork,旨在降低推理成本。据Axios报道,微软考虑托管DeepSeek V4作为更便宜选项,同时将Copilot...
MAME Power Macintosh仿真取得进展:Claude Code协助修复多项Bug
开发者使用Claude Code控制并调试MAME的Power Macintosh仿真。Claude通过生成Lua脚本和修改日志,发现了6522 VIA仿真故障、PowerPC DRC缓存值未覆盖实际状态的反模式、PowerPC 601的两处Bug,以及原子加载/存储指令模拟错误。修复后,Pippin播放启动音并显示Logo、鼠标可移动;PowerMac...
OpenAI o3 研究助解罕见儿科病例
与波士顿儿童医院和哈佛的研究人员合作,我们在NEJM AI上发表了一项研究,展示了o3 Deep Research如何帮助临床医生重新审视此前未解决的罕见儿科疾病案例,并为等待多年的家庭找到答案。
Mythos 级开源模型不会太久
@jietang 回复 @elonmusk 和 @teortaxesTex:"不会花那么久。" 主推文期待早日看到 Mythos 级别的开源模型👍
如何将 SillyTavern 连接到 OpenRouter(2026 指南)
一个 OpenRouter API 密钥即可在 SillyTavern 的下拉菜单中解锁 300 多个模型,其中许多免费。指南包含五步连接流程、推荐尝试的角色扮演模型以及常见错误的修复方法。
我国首部L3/L4自动驾驶强制性国标公示:2027年7月起实施
工信部6月16日就《智能网联汽车自动驾驶系统安全要求》等2项强制性国标公开征求意见,公示至6月24日,建议2027年7月1日起实施。该标准系我国首部针对L3/L4的强制性国标,要求系统安全水平至少达到"合格且专注驾驶人",引入Safety Case机制。L3重点规范人机交接,L4强调自身风险处置、不得依赖远程协助。新申请车型实施日起执行,已获批车型有约一年过渡期。
我国首部L3/L4自动驾驶强制性国标公示:2027年7月起实施
工信部6月16日就《智能网联汽车自动驾驶系统安全要求》等2项强制性国标公开征求意见,公示至6月24日,建议2027年7月1日起实施。该标准系我国首部针对L3/L4的强制性国标,要求系统安全水平至少达到"合格且专注驾驶人",引入Safety Case机制。L3重点规范人机交接,L4强调自身风险处置、不得依赖远程协助。新申请车型实施日起执行,已获批车型有约一年过渡期。
Epoch AI 招聘设计师,推动研究可视化
Help shape how the world understands AI. We're hiring two designers at Epoch AI to turn complex research into dashboards and visualizations researchers and policymakers can easily use. 帮助塑造世界理解 AI...
商汤发布SenseNova-U1 LoRA:12.5倍推理加速
商汤推出 SenseNova-U1-8B-MoT-Infographic 模型的 8-step 蒸馏 LoRA(SenseNova-U1-8B-MoT-Infographic-LoRA-8step-V1.0),实现 12.5 倍推理加速,信息图(infographic)生成质量基本与基模型持平。模型权重已开源至 HuggingFace,GitHub 提供使用文档。
抱歉,您提供的"主推文内容"是一个链接(http://x.com/i/article/2067522740555493376),我无法直接访问外部网页来获取原文。请直接将推文文本粘贴过来,我会按照您的要求翻译并生成10-15字的中文标题。
(如果您希望我根据链接标题或已知信息推测,但【防幻觉规则】不允许无依据增补,所以请提供原文。)
盖洛普最新研究:不经常使用 AI 的员工更容易成为被裁员对象
盖洛普今年2月对超2.3万名美国劳动者的调查显示,经常使用AI的员工被裁员风险更低。在美国科技行业,每月至少使用一次AI的员工预计被裁概率约6%,使用较少的达18%。科技行业外也存在类似趋势但差距较小。排除年龄、学历等因素后关联仍然存在。AI正形成新的职业分水岭,企业招聘已考察AI熟练程度。仅约1%被裁员工认为AI是直接原因,更多人归因于组织重组,但研究人员认为AI可能间接影响。
SkillWeaver:组合式技能路由用于LLM智能体
传统LLM智能体技能路由仅从工具库选取单一技能,难以应对多技能组合的真实任务。本文形式化定义"组合式技能路由",将复杂查询分解为原子子任务,为每个子任务检索对应技能并组合成可执行计划。系统SkillWeaver由LLM分解器、双编码器FAISS检索器和依赖感知DAG规划器构成。同时发布CompSkillBench基准,含300个组合查询和2,209个真实技能,直接评估多技能路由能力。DAG规...
Nature两篇研究:MIRA和AMIE诊断与治疗计划媲美甚至超越医生
德国团队开发的MIRA智能体在模拟电子病历中操作85,000种选项,500余例急诊诊断准确率88.9%,对比测试(311例)得分87.8%,高于资深专科医生(78.1%)和混合团队(71.1%)。MIRA在阑尾炎(98.6%)和胰腺炎(92.3%)最佳,未发现危险药物交互或剂量错误,性能不受语言影响,代码已公开。谷歌AMIE采用双智能体架构,在100个多访视病例中治疗计划适切率95%(初级保...
Nature两篇研究:MIRA和AMIE诊断与治疗计划媲美甚至超越医生
德国团队开发的MIRA智能体在模拟电子病历中操作85,000种选项,500余例急诊诊断准确率88.9%,对比测试(311例)得分87.8%,高于资深专科医生(78.1%)和混合团队(71.1%)。MIRA在阑尾炎(98.6%)和胰腺炎(92.3%)最佳,未发现危险药物交互或剂量错误,性能不受语言影响,代码已公开。谷歌AMIE采用双智能体架构,在100个多访视病例中治疗计划适切率95%(初级保...
Google 无前沿模型,Gemini 3.1 Pro 落后
有意思的是,Google 不再拥有公开的前沿模型。他们有一个非常好的 flash 模型,但如果没有好的前沿协调器,一个非常好的 flash 模型也无法完成前沿工作。 我确信这种情况很快就会改变,但 Gemini 3.1 Pro 目前明显落后。