RSS

  • 宝玉的分享
    https://baoyu.io/feed.xml
    刷新于
  • AIHOT 日报
    https://aihot.virxact.com/feed/daily.xml
    刷新于
  • AIHOT — 全部 AI 动态
    https://aihot.virxact.com/feed/all.xml
    刷新于
  • AIHOT — 精选
    https://aihot.virxact.com/feed.xml
    刷新于

webAI 开源 1.7B 逻辑模型 TwiL-LM3,击败 GPT-OSS-120B

webAI 开源 TwiL-LM3,一款 1.7B 参数的正式逻辑推理模型,在 5 项形式推理基准中 4 项超越 OpenAI 的 GPT-OSS-120B,参数量少 40 倍,推理速度快 2.6 倍,可在手机和树莓派等消费级硬件上运行。该模型通过 289MB LoRA 适配器微调基础模型而来,基于专有数据引擎训练,专注于将自然语言转化为形式逻辑并验证结论。 🔗 阅读原文 via...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

鼓励性话语也能提升大语言模型表现,Claude 意外改进黎曼猜想零点下界

研究发现,"相信自己!"这类鼓励性话语不仅能激励人,也能帮助大语言模型提升表现。Anthropic 让未发布版 Claude 尝试攻克黎曼猜想,虽未证明,却意外将满足假设的 zeta 函数零点比例下界从 41.6% 提升至 67.2%,期间协调了 60 个子智能体并形式化验证了结果。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

金尼药房因数百起客户投诉下架AI手机助手Burt

金尼药房(Kinney Drugs)在收到数百起客户投诉后,缩减其AI手机助手Burt的使用范围。客户反映该助手通话内容混乱、提供错误剂量并漏发处方通知。药房将恢复传统的按键式电话系统处理来电,但Burt仍将用于处方续药短信等外发通信,患者需主动选择接收。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsnm21kj0d5hrohfp5uqysve

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

建立循环的循环:后台智能体新思路

建立循环的循环 【引用 @threepointone】:新文章:每家公司都需要一个卡珊德拉。 https://sunilpai.dev/posts/every-company-needs-a-cassandra/ 文中我提议打造一个人们本不愿与之共事的后台智能体/工作进程。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:swyx (@swyx))

SAP 因 AI 成本飙升暂停大部分差旅和招聘

SAP 上月因 AI 成本飙升暂停了大部分差旅和招聘活动,仅对 AI 相关的差旅或招聘例外放行。内部邮件显示该禁令目前仍有效,一名员工称公司正将新 AI 工具推广至全公司,预计将大幅推高成本。此举反映出企业正面临 AI 开支失控的现实,部分公司已开始限制员工 AI 使用以控制成本。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))

Omnigent 上下文策略如何阻断"致命三重奏"组合攻击

Omnigent 的上下文策略(Contextual Policies)可阻断"致命三重奏"组合攻击--即多个看似无害的请求叠加后形成的恶意行为。该机制在单个请求层面不设防,而是在组合上下文中识别并拦截风险,从而在不牺牲正常功能的前提下提升安全性。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsnkk68z0byorohfynveywic

noreply@aihot.virxact.com (Databricks:Blog(RSS))

Dyna-2 世界动作模型发现新缩放定律

DynaRobotics 推出 Dyna-2,一个基于 100 万小时人类视频预训练的世界动作模型,可同时预测未来视频与动作。首次发现人类数据在 1000 至 100 万小时四个数量级上的缩放定律,并外推至未见过的机器人数据,表明世界建模与视频数据缩放对跨本体迁移至关重要。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Elvis Saravia (@omarsar0, DAIR.AI))

Claude研究版提升黎曼零点下界

一个未发布的研究版本 = 没什么大不了 【引用 @AnthropicAI】:我们让一个未发布的研究版 Claude 尝试攻克黎曼猜想。 它没有解决该猜想,但在一个相关问题上取得了进展:它将满足猜想的黎曼ζ函数零点比例的下界从 41.6% 提高到了 67.2%。 https://www.anthropic.com/research/riemann-zeta 🔗 阅读原文 via AIHOT...

noreply@aihot.virxact.com (X:马东锡 NLP (@dongxi_nlp))

Lindy 用共享记忆解决 AI 工作上下文瓶颈

Lindy 推出 Teammate,定位从 AI 智能体升级为"AI 员工",团队成员可在 Slack 中直接使用。其核心是解决 AI 工作上下文割裂问题:通过跨会议、Slack、文档及 Gmail、Linear、Salesforce、Stripe 等系统的共享状态,让记忆以团队可检查、编辑或删除的文件形式存在,避免上下文随聊天窗口消失。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Rohan Paul (@rohanpaul_ai))

OpenAI 发布 GPT-5.6-Cyber 强化防御

OpenAI 发布 GPT-5.6-Cyber,这是其首个大规模直接提升高级网络安全任务(如漏洞利用开发)能力的模型。该模型在加速防御性工作方面表现强劲,已用于内部红队测试,并帮助安全研究人员发现和修复大量开源软件中的 0-day 漏洞。Sam Altman 呼吁业界考虑使用该模型来防御自身系统。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Sam Altman (@sama))

Claude 未解黎曼猜想却改进关键下界

Anthropic 让未发布版 Claude 尝试黎曼猜想,虽未解决,却将满足猜想的黎曼 zeta 函数零点比例下界从 41.6% 提升至 67.2%。Claude 协调 60 个子智能体、测试数百个想法并检索文献,还用 Lean 形式化验证了结果。这被视为自主 AI 驱动科学发现的早期范例。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Kim (@kimmonismus))

FineBooks 项目评测 14 款开源 OCR 模型:小模型胜出,历史书籍文本可作 AI 训练数据

Hugging Face 与 EleutherAI 的 FineBooks 项目在 2,165 页历史书籍上评测了 14 款开源 OCR 模型。最佳模型 dots.mocr(3B 参数)字符准确率超 97%,每千页成本低于 2 美元,且小模型普遍优于大模型。研究认为输出质量足以用于 AI 训练,但尚不适合学术用途。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (The Decoder:AI News(RSS))

MiniMax 将携 H3 模型亮相 AiOS 旧金山活动

MiniMax 宣布参加 AiOS San Francisco 活动,届时将现场演示其视频生成模型 MiniMax H3 在 Mac 上的本地运行。活动还包含 Wendy Labs 展示 Swift 驱动的 AI 应用部署至机器人与嵌入式设备,以及由前 Apple 员工主持的开幕座谈,时间为明日旧金山当地下午 6 点。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:MiniMax (@MiniMax_AI))

Claude 推动黎曼猜想证明率跃升25.6个百分点

Claude 的这一惊人成果,是自 2013 年有界素数间隔以来解析数论领域最重大的突破。 它将黎曼 zeta 函数临界线上已被证明的零点比例提升了 25.6 个百分点。而在此前 37 年间,数学家们仅将其推进了 0.8 个百分点。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsnjzne60bg6rohfw0nittqg

noreply@aihot.virxact.com (X:Deedy Das (@deedydas))

Claude 研究版提升黎曼猜想零点下界

有时候你只需要告诉 Claude 继续下去 @jarredsumner 【引用 @AnthropicAI】:我们让一个未发布的研究版 Claude 尝试攻克黎曼猜想。 它没有解决该猜想,但在一个相关问题上取得了进展:它将满足猜想的黎曼 zeta 函数零点比例的下界从 41.6% 提升到了 67.2%。...

noreply@aihot.virxact.com (X:Thariq (@trq212))

Ethan Mollick 质疑 Claude 黎曼猜想提示词技巧

Ethan Mollick 对 Anthropic 用提示词引导 Claude 攻克黎曼猜想相关问题的做法表示质疑,称其早期实验(用稍旧模型)未发现该提示词方法能稳健奏效。Anthropic 称未发布的研究版 Claude 将满足黎曼猜想的零点占比下界从 41.6% 提升至 67.2%。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Ethan Mollick (@emollick))

OpenAI 推出 GPT-5.6-Cyber,帮助防御者在攻击者之前发现漏洞

OpenAI 扩展 Daybreak 网络安全计划,新增 Blue 与 Red 两个访问层级,并推出专为进攻性安全研究训练的 GPT-5.6-Cyber 模型。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsnjzngu0bgcrohfvunwl6q2

noreply@aihot.virxact.com (The Decoder:AI News(RSS))

Claude 研究版突破黎曼猜想下界

还记得我们曾以为提示工程师会是一份工作吗 🤷♀️ 我们让一个未发布的研究版 Claude 尝试攻克黎曼猜想。 它没有解决该猜想,但在一个相关问题上取得了进展:它将满足猜想的黎曼 zeta 函数零点比例下界从 41.6% 提高到了 67.2%。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsnjbogp08uqrohfm0e8cuav

noreply@aihot.virxact.com (X:Emad Mostaque (@EMostaque))

数据中心与历次工业革命轻工业的就业差异

数据中心与以往工业革命中的轻工业相比,一个真正的问题在于它们不需要很多人来运营(尽管建设它们需要更多人)。这打破了产业在明显的本地负面外部性与明显的本地收益之间的权衡。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsnjzj8g0bdjrohfsu5hibjo

noreply@aihot.virxact.com (X:Ethan Mollick (@emollick))

OpenAI 推出 GPT-5.6-Cyber 与 Daybreak 新层级

OpenAI 扩大网络安全计划 Daybreak,推出新模型 GPT-5.6-Cyber,用于高级、经授权的网络安全工作。同时新增 Daybreak Blue 与 Red 访问层级,以加速防御能力。OpenAI 表示,此举旨在让可信防御者在攻击者大规模部署进攻性 AI 之前掌握前沿智能。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Tibo (@thsottiaux))

OpenAI 推出 GPT-5.6-Cyber 与 Daybreak 新层级

OpenAI 扩大网络安全计划 Daybreak,推出专用于高级授权安全工作的新模型 GPT-5.6-Cyber,并新增 Daybreak Blue 与 Red 访问层级,以加速防御能力。该举措旨在让可信防御者在攻击者大规模部署进攻性 AI 之前,率先获得前沿智能。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Tibo (@thsottiaux))

Odyssey 发布慢呼吸表面动画

一次缓慢的呼吸掠过表面。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsnjzokm0bgurohfd9262st7

noreply@aihot.virxact.com (X:Odyssey (@odysseyml))

蚂蚁百灵Ling模型获vLLM首日支持

Ling 模型通过我们的 day0 合作伙伴将包容性带到各类设备。感谢 @vllm_project 的持续支持! 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsnjzjy80be6rohfscjqac9c

noreply@aihot.virxact.com (X:蚂蚁百灵 (@AntLingAGI))

专家询问高级AI网络攻击对策研究数据

是否有已发表的数据或研究,能够支持以下两种观点中的任何一种:"阻止高级AI网络攻击的方法是让所有人同时获得高级AI"与"阻止高级AI网络攻击的方法是在很长一段时间内仅限关键企业使用"? 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsnjzj8g0bdkrohf8qhcerzw

noreply@aihot.virxact.com (X:Ethan Mollick (@emollick))

Claude 未发布研究版将黎曼 zeta 函数零点下界从 41.6% 提升至 67.2%

Anthropic 员工让 Claude 尝试攻克黎曼猜想,虽未成功,但一个未发布的研究版 Claude 在相关问题上取得突破:将满足黎曼猜想的 zeta 函数零点比例下界从 41.6% 提升至 67.2%。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsnix1by08d3rohfftiex1xp

noreply@aihot.virxact.com (Anthropic:Research(发表成果 · 网页))

Claude 未发布研究版将黎曼 zeta 函数零点下界从 41.6% 提升至 67.2%

Anthropic 员工让 Claude 尝试攻克黎曼猜想,虽未成功,但一个未发布的研究版 Claude 在相关问题上取得突破:将满足黎曼猜想的 zeta 函数零点比例下界从 41.6% 提升至 67.2%。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsnix1by08d3rohfftiex1xp

noreply@aihot.virxact.com (Anthropic:Research(发表成果 · 网页))

Cursor 设计负责人离职赴亚洲引热议

Cursor 设计负责人 @ryolu_ 在公司估值飞涨时离职,前往亚洲重新开始。他在旧金山科技圈工作 10 年,曾任职 Asana、Stripe、Notion 创始设计师,称需要更慢的节奏、更多文化、aliveness 和日常真实连接。主推文作者认为这是主动选择,而非逃离。 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:阿易 AI Notes (@AYi_AInotes))

OpenAI 得州 AI 基建责任建设之道

我们如何在得克萨斯州负责任地建设 AI 基础设施:https://openai.com/index/responsible-ai-infrastructure-texas/ 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsnix4cv08f2rohfycbqu4oi

noreply@aihot.virxact.com (X:Greg Brockman (@gdb))

Claude 研究版推进黎曼猜想相关证明

我们让一个未发布的研究版 Claude 尝试攻克黎曼猜想。 它没有解决该猜想,但在一个相关问题上取得了进展:它将满足该猜想的黎曼 zeta 函数零点比例的下界从 41.6% 提高到了 67.2%。 https://www.anthropic.com/research/riemann-zeta 🔗 阅读原文 via AIHOT ·...

noreply@aihot.virxact.com (X:Anthropic (@AnthropicAI))

Lindy Teammate 上线:AI 员工替代 AI 智能体

Lindy 推出 AI 员工 Lindy Teammate,用户可在 Slack 中直接@它完成任务,替代过去事事找同事的协作方式。它能从会议、文档和已连接工具中提取答案并标注来源,且持续学习,成为企业自我更新的知识中枢。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsniu8dr088zrohf2yegypuq

noreply@aihot.virxact.com (X:Elvis Saravia (@omarsar0, DAIR.AI))
上一页 第 62 / 884 页 下一页

添加 Feed

导入 OPML