RSS

  • 宝玉的分享
    https://baoyu.io/feed.xml
    刷新于
  • AIHOT 日报
    https://aihot.virxact.com/feed/daily.xml
    刷新于
  • AIHOT — 全部 AI 动态
    https://aihot.virxact.com/feed/all.xml
    刷新于
  • AIHOT — 精选
    https://aihot.virxact.com/feed.xml
    刷新于

BestBlogs早报:OpenAI Codex谈品味策展、Cloudflare机器人流量超人类、陪伴机器人"小伴"、DSpark推测解码等

OpenAI Codex负责人称,代码实现成本趋近于零后,产品瓶颈转向品味与策展。Cloudflare CEO预测2026上半年机器人流量超人类,五年后或达千倍,广告模式难以为继,公司已裁20%团队并扩管理幅度至12:1。陪伴机器人"小伴"采用端侧1.7B+7B模型,延迟压至0.4秒。Grok...

noreply@aihot.virxact.com (X:洪明 (@hongming731))

BestBlogs 早报:AI 降低实现成本后,品味、流量结构与陪伴设计成为新焦点

OpenAI Codex 负责人指出,写代码成本趋近零后,品味与策展成为产品新瓶颈。Cloudflare CEO 透露,2026 年上半年平台机器人流量首次超过人类,互联网广告模式面临根本改变。越伴动力创始人分享陪伴机器人"小伴"的取舍--0.4 秒以内延迟与"不讨好"设计,旨在打造能长期生活的生命。 🔗...

noreply@aihot.virxact.com (X:洪明 (@hongming731))

网友发现OpenAI自有库

刚刚发现@OpenAI有自己的库?? 🔗 阅读原文:https://x.com/jxnlco/status/2071373691687256173

noreply@aihot.virxact.com (X:Jason Liu (@jxnlco))

Cybercabs 无人出租车占领奥斯汀

Cybercabs 正在占领奥斯汀。 🔗 阅读原文:https://x.com/cb_doge/status/2071372660638884037

noreply@aihot.virxact.com (X:cb_doge (@cb_doge))

苹果因AI需求挤占产能,提前放弃2nm转向1.4nm,A22 Pro率先采用

AI芯片需求爆发使台积电3nm产能饱和,苹果预见2nm将面临同样局面,因此加速转向1.4nm。今年苹果采用台积电N2(2nm),2027年升级至N2P,随后在2028年的A22...

noreply@aihot.virxact.com (IT之家(RSS))

布朗大学教授揭发至少50名学生用AI作弊,称校方反应冷淡

布朗大学经济学教授Roberto Serrano在ECON 1170课程3月的期中考试中发现至少50名学生使用AI作弊,成为布朗及整个常春藤盟校已知最大规模作弊丑闻。Serrano向校方高层报告后,校长保持沉默,院长也未回应,直至案件提交学术准则委员会才得到"警钟"式承认。Serrano认为学术诚信值得捍卫,呼吁大学公开承认问题严重性并展开广泛辩论,以避免AI终结高等教育的声誉与价值。 🔗...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

百度旗下昆仑芯计划赴港IPO,目标估值500亿美元

百度旗下AI芯片子公司昆仑芯(Kunlunxin)计划在香港上市,目标估值约500亿美元(约3405.58亿元人民币)。参与IPO的部分投资者被要求认购相当于其计划申购金额3-7倍的芯片产品。腾讯已成为昆仑芯客户。昆仑芯于今年1月1日通过联席保荐人向港交所提交上市申请表。该公司成立于2012年,最初为百度内部AI芯片业务部门,后独立运营,百度仍为控股股东。 🔗...

noreply@aihot.virxact.com (IT之家(RSS))

BIS警告:AI热潮背后的债务或引发下一场金融冲击

BIS警告,AI热潮背后积累的债务可能引发金融冲击。风险不在AI本身,而在于围绕尚未被证明持久性的收入构建的杠杆化供应链。若AI需求不及预期,数据中心支出放缓,借款者难偿还,压力从科技蔓延至信贷市场。超大规模企业2025年债券发行超1000亿美元;表外工具将数据中心债务转移至私人信贷基金和保险机构;私人信贷基金5年内AI/IT敞口翻两番至约15%,部分零售基金已面临赎回压力。美国股市占MSC...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

AIE周旧金山今晚新工程师见面会

如果你在旧金山参加AIE周,今天下午5点到9点请来Moscone中心领取徽章并参加新工程师入职介绍--认识朋友,规划你的周行程,并向新手伸出援手! 如果担心推文太多,记住你可以使用AI Eng X社区: https://x.com/i/communities/1929211810798043448 🔗 阅读原文:https://x.com/swyx/status/2071364057622569151

noreply@aihot.virxact.com (X:swyx (@swyx))

研究:AI智能体缺乏真正记忆系统,现有评测忽略记忆自身性能

一篇新论文指出AI智能体目前缺乏真正的记忆系统。现有测试只检查最终答案,忽略了记忆系统本身的性能。论文将智能体记忆拆分为存储、事实提取、有用记忆检索、旧/冲突记忆维护四部分,在12个记忆系统、5个工作负载、11个数据集上评测。核心发现:没有一种记忆设计能在所有场景胜出--图记忆擅长关联事实,混合系统善于过滤搜索,原始痕迹则在精确动作历史记录中表现最佳。 🔗...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

MiniMax M3黑客松获奖项目展示

祝贺所有与我们和@cysic_xyz 联合举办的黑客松的获奖者! 查看基于 M3 构建的出色项目 👇 🔗 阅读原文:https://x.com/MiniMax_AI/status/2071360899173298202

noreply@aihot.virxact.com (X:MiniMax (@MiniMax_AI))

这种AI视频也挺有意思的😂

这种AI视频也挺有意思的😂 🔗 阅读原文:https://x.com/dotey/status/2071357697585242300

noreply@aihot.virxact.com (X:宝玉 (@dotey))

Codex团队周日紧急排查用户消耗异常

Codex 团队周日待在作战室里,梳理日志,检查是否有任何可能导致部分用户使用消耗增加的情况。他们非常重视此事,不彻底查清绝不罢休。 🔗 阅读原文:https://x.com/thsottiaux/status/2071357473659707441

noreply@aihot.virxact.com (X:Tibo (@thsottiaux))

Anthropic 发布 Claude Tag,在 Slack 内 @Claude 异步执行任务

Anthropic 上周面向 Team 和 Enterprise 用户 beta 发布 Claude Tag,允许在 Slack 频道内 @Claude 布置任务,后台异步执行并回复。Andrej Karpathy 称这是 LLM 交互的第三次重新设计--从网站到 App 再到持久存在的云端智能体。Gergely Orosz 指出真正突破是云端 AI 接入公司内部系统并开箱即用,Slack...

noreply@aihot.virxact.com (X:宝玉 (@dotey))

七月将至,期待大模型集中发布

下周就是七月了。 虽然六月相对平静(当然,GLM 5.2 是一次重大发布),但我们仍在等待那些重大发布。 至少目前,我对 Sonnet 5 就已经很满意了。但想必我们也很快就会知道,我们是否以及何时能重新获得 Fable 5 和 GPT 5.6(以及欧洲是否能用上)。 期待感正在升温。 🔗 阅读原文:https://x.com/kimmonismus/status/2071356006886518976

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

ChatGPT 助力班加罗尔日常生活

ChatGPT 用于在班加罗尔日常生活中的帮助:https://www.ndtv.com/offbeat/auto-rickshaw-driver-shows-how-chatgpt-helps-in-daily-life-openai-reacts-11698499 🔗 阅读原文:https://x.com/gdb/status/2071355421819097520

noreply@aihot.virxact.com (X:Greg Brockman (@gdb))

Jon Udell:AI 智能体应被邀请进入开发循环,而非将人类排除在外

Jon Udell 反对"human in the loop"的表述,认为它将权威让渡给机器。他主张翻转叙事--人类本就主导工作循环,现在应主动招募 AI 智能体加入团队。智能体辅助的开发过程不应是"输入提示词、输出功能"的黑箱,而是人类邀请智能体协作的开放循环。 🔗 阅读原文:https://simonwillison.net/2026/Jun/28/jon-udell

noreply@aihot.virxact.com (Simon Willison 博客)

祝大家AI夏天快乐

AI夏天快乐 🔗 阅读原文:https://x.com/gabriel1/status/2071352008892928232

noreply@aihot.virxact.com (X:Gabriel (@gabriel1))

智谱GLM-5.2在网络安全漏洞发现上匹敌Mythos

中国智谱发布开源权重模型GLM-5.2,研究人员称其在某些漏洞发现和网络安全场景下能匹敌Anthropic的Mythos。尽管GLM在通用任务上仍落后于Anthropic和OpenAI的模型,但在漏洞发现能力上中美差距已显著缩小。作为开源权重模型,GLM-5.2可在普通硬件上自由下载运行,灵活性高但易被滥用。美国政府此前已限制中国获取Mythos、Fable等先进模型及训练硬件,此番进展引发...

noreply@aihot.virxact.com (The Verge:AI(RSS))

RepoPrompt 已开源,社区版上线GitHub

RepoPrompt 已开源,社区版上线GitHub。作者Provencher被OpenAI招安,条件是为付费用户做好安排:先免费再开源,付费用户获赠Codex Credits。该工具从仓库挑选文件生成prompt,解决超32K token使模型变笨的问题,称为"上下文工程"。开源版反转架构:内置MCP...

noreply@aihot.virxact.com (X:宝玉 (@dotey))

GLM 5.2 在 IDOR 检测中超越 Claude Code

Semgrep 团队用 IDOR 基准测试比较开源模型与前沿编码智能体。GLM 5.2(智谱 AI,开源权重,MIT 许可)以 39% F1 成绩超越 Claude Code(32%),每发现一个漏洞成本约 0.17 美元,但仍低于 Semgrep 多模态流水线(53-61% F1)。GLM 5.2 采用 MoE 架构,总参数 7500 亿,每 token 仅激活约 400 亿,支持...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

由于AI表现未达预期,福特重新聘用"灰胡子"工程师

福特重新聘用350名资深工程师(部分为前员工,部分来自供应商),原因是AI和自动化质量系统未达预期效果。首席运营官Kumar Galhotra表示公司此前过度依赖自动化质量系统,结果令人失望,因此召回技术专家在零件进入工厂前排查故障点。福特并未放弃AI,而是让这些"灰胡子"工程师培训年轻员工并重新编程AI工具。此举预计今年将节省10亿美元成本,福特本周还在JD...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

Vida开源BrowserBC:浏览器会话→AI智能体技能

Vida 开源了 BrowserBC 框架,能将浏览器会话转化为 AI 智能体的可重用技能。仅需一次录制,智能体即可依据之前任务执行的技能导航,无需每次重新计算。Vida 报告称,使用相同 AI 智能体,该方法成功率显著更高且步骤更少。 🔗 阅读原文:https://x.com/testingcatalog/status/2071341043790880944

noreply@aihot.virxact.com (X:Testing Catalog (@testingcatalog))

LeptonAI 创始人收购一年后离职

突发新闻:LeptonAI 创始人兼 CEO 在收购仅一年后离职。这相当令人震惊,据报道 Jensen 花费 7 亿美元收购 LeptonAI。他看到了什么?DGX Lepton 惨败,远未达到 Jensen 预期的成功。1/7🧵 🔗 阅读原文:https://x.com/SemiAnalysis_/status/2071337888059408701

noreply@aihot.virxact.com (X:SemiAnalysis (@SemiAnalysis_))

FT:Google限制Meta使用Gemini

Google限制了Meta对Gemini模型的使用,原因是Meta要求的计算容量超出Google供应能力。Meta在安全自动化、客服、广告工具、编程及内部工作流中均依赖Gemini。Google面临自身云客户、Gemini产品与有限数据中心容量之间的资源竞争。Google Cloud 3月季度收入增至200亿美元,CEO Sundar...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

PlanBench-XL:评估LLM智能体在大规模工具生态中的长程规划能力

论文提出PlanBench-XL基准,包含327个任务和1,665个工具,测试LLM智能体在工具难以发现时完成长程工具使用任务的能力。GPT-5.4常规准确率为51.90%,最困难的blocked设置降至11.36%。核心思路是让智能体同时从已知向前推理和从需求向后推理,而非依赖显式工具路径。论文还加入破损或误导性工具,考验智能体在路径失败时自主切换策略。 🔗...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

Grok 4.5 基于 1.5 万亿参数 V9 基础模型开发,规模为 v8 的 3 倍

Grok 4.5 基于 xAI 的 1.5 万亿参数 V9 基础模型开发,并使用了 Cursor 数据,规模约为现有 v8-small 模型(0.5 万亿参数)的 3 倍。Elon Musk 指出,v8 基础模型(Grok 4.3)于 12 月完成训练,存在许多根本性缺陷,因此 Grok 4.5 将是一次巨大升级。他还强调,SpaceXAI...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

AI Safety Memes 发大笑推文

笑死我了 🔗 阅读原文:https://x.com/AISafetyMemes/status/2071329884262289587

noreply@aihot.virxact.com (X:AI Safety Memes (@AISafetyMemes))

Suno推出Spark孵化器项目,为AI模型喂养独立艺术家

Suno近日推出Spark孵化器项目,面向未签约的独立歌手、词曲作者和制作人,提供资助、导师指导和营销支持。参与艺术家需同意将作品在Suno上开放remix,授予Suno广泛许可(含创作衍生作品),同时放弃陪审团审判和集体诉讼权利,并给予Suno有限独家权。项目还包含"Good Vibes...

noreply@aihot.virxact.com (The Verge:AI(RSS))

开放互联网孕育AI,开源保障AI不被封闭

强调开放互联网是现代AI的训练基础--数十亿文本、论坛帖子、代码仓库、百科、论文、博客等共同构建了全球知识空间,这一自由知识已被转移进AI。因此AI不应完全消失于专有壁垒之后。闭源模型当前虽在最强模型上领先,但如果地缘政治上对智能的获取日益受限制、管控和控制,开源就不再只是技术理想,而是权力问题。针对"开源仍无法真正查看模型内部,算不上真'自由'"的质疑,作者表示观看视频后反而更坚信开源的立...

noreply@aihot.virxact.com (X:Kim (@kimmonismus))
上一页 第 547 / 977 页 下一页

添加 Feed

导入 OPML