2026-08-03日刊
TL;DR
AI资讯日报 2026/8/3 AI资讯 | 每日早读 | 全网数据聚合 | 前沿科学探索 | 行业自由发声 | 开源创新力量 | AI与人类未来 | 访问网页版↗️ | 进群交流🤙 今日摘要 新锐公司开源多模态大模型,谷歌发布八代双芯算力硬件 阿里与南大研发数字人框架,谷歌研究模型意识与价值偏好 谷歌高管指出上下文工程成新护城河,扫书与爬虫引发版权争议 华为诺亚开源智能体记忆系统,开源推理引擎助力大模型本地运行 社交媒体热议模型极低成本价格战,机器人公司展示攀爬楼梯 产品与功能更新 Inkling开放多模态权重。 Thinking Machines发布Inkling新模。2760亿总参⚙️仅激活120亿。模型原生处理文字图像与音频。查看官方模型技术发布详情(AI资讯)已披露权重。NVFP4支持单张B300运行。 Presence推进企业智能体。 OpenAI推出Presence企业方案。产品瞄准客服🤖与内部业务流程。它专攻面向外部用户的部署。查看企业智能体完整报道披露工程师介入。企业智能体落地门槛有望降低。 英伟达开源Molt框架。 研究者可读完8. 6K行核心。框架经英伟达发布原文(AI资讯)披露🧪可跑H100。它组合Ray与vLLM。普通Python代理可直接训练。 谷歌发布八代TPU双芯。 谷歌云官方解读(AI资讯)披露双芯分工。 TPU 8t专盯🧠训练大模。 9600芯片扛2PB内存。 TPU 8i主攻⚡低延推理。 80%性价比提振Agent服务。 前沿研究 TaoMate稳定分钟级数字人。 阿里与南大提出TaoMate框架。221亿参数支撑流式音视频。锚点记忆🧭压制长视频画面漂移。查看数字人生成论文原文披露三卡达35帧。该方案或推动直播数字人落地。 Stream3D补全流式三维。 哈佛与两所高校发布Stream3D。系统从连续视角📡提取空间证据。查看流式三维研究论文公开实现细节。固定容量记忆无需重新训练。GSO测试的CD降至0. 048。 谷歌研究模型意识表述。 谷歌论文研究模型的心智自认。激活干预🧠改变价值与情绪回答。查看模型意识研究论文呈现实验方法。移除拒答向量后得分升至4. 77。九十五道问题的回答更近人类。 CausalVLBench测试视觉因果。 阿肯色团队推出视觉因果基准。基准覆盖因果干预与反事实任务。现有多模态模型🧩仍明显吃力。查看视觉因果评测论文开放实验细节。配套代码仅获**⭐4**仍便于复现。 行业展望与社会影响 Jeff Dean研判智能体方向。 Jeff Dean称智能体将长期试错。TPU经验⚙️提示应先锁定算力瓶颈。查看模型创业趋势完整访谈提出寻找模型盲区。上下文工程正成为新护城河。产品品味将比基础编码更稀缺。 真实使用正在改写估值。 研究用380万亿令牌构建信号。股价对使用需求的敏感度被量化。查看人工智能溢价研究原帖披露结论。高敏感企业📈后续收益表现更强。剔除科技板块后结果依然有效。 鹈鹕测试引爆AI争论。 Karpathy用Pelican🪽检验生成能力。社区在鹈鹕测试原帖热议(AI资讯)里质疑革命。Wave式协作💬被重新想起。Agent与版权争议仍在发酵。 AI扫书毁本引爆版权争议。 AI公司扫稀书后销毁原件。版权⚖️与合理使用拉扯升温。扫描件未开放,黑客新闻热议此事(AI资讯)质疑圈地。旧语料🗂️被视作稀缺燃料。公众担心知识变成围墙。 AI爬虫引用争议升温。 仅8. 8%从未获引用。争论指向黑客新闻原帖(AI资讯)的可见性黑箱。站长担心GEO💼成新军备赛。 开源TOP项目 MindMemOS让记忆持续进化。 华为诺亚开源MindMemOS记忆层。它把记忆🧠从单个智能体中解耦。查看智能体记忆开源仓库暂未展示星数。三维结构保存状态与演化轨迹。双榜成绩达到94. 63%。 AirLLM突破显存限制。 AirLLM缓解大模型显存压力。700亿模型可在4GB显卡运行。查看轻显存推理项目主页已获**⭐25. 6k**。项目单日猛增🚀819颗星。个人部署大模型门槛继续下探。 k-skill深耕韩国本地语境。 项目为智能体补齐韩国任务能力。技能库收录本地语境与实用工具。查看韩国智能体技能仓库已获**⭐6886**。项目单日新增🌱177颗星。本地化智能体生态开始快速扩散。 ds4支持多端本地推理。 ds4让DeepSeek4登陆本地设备。引擎兼容Metal与两类显卡后端。查看多端推理开源仓库已获**⭐19. 9k**。项目单日新增🛠️139颗星。多硬件支持有望减少云端费用。 社媒分享 谷歌错过LMChat窗口。 谷歌旧将称LMChat已成型。能聊写答,像后来的ChatGPT。原帖披露谷歌旧闻细节称高层怕伤搜索💸。OpenAI发布后⚡谷歌急追,人才流向竞品。 DeepSeek引发价格战讨论。 帖子称单任务成本低至三美分。多款高价模型落入定价斩杀区。查看模型定价观点原帖展示成本分布。130亿激活参数推动代理跃升. 相关数据⚠️仍需等待官方验证。 开放模型迈入决胜阶段。 训练成本持续呈数量级上涨。实验室整合预期却📊明显降温。查看开放模型趋势观点讨论行业变化。多家团队仍投入亿级资金训练。中美玩家争夺开放权重影响力。 Kimi K3开源模型深读。 2. 78万亿参数受关注。KDA⚙️提升长上下文能力。稳定MoE训练更稳当。博文详见技术深读全文(AI资讯)邀讨论。 Figure机器人挑战爬楼。 Figure F. 03公开爬楼演示。四肢需完成紧密非周期协调动作。查看人形机器人爬楼原帖记录完整过程。上行动力必须托起全身重量。手脚接触力🤖还需实时调整。 Grok视频生成意外走红。 网友称Grok像视频版DeepSeek。一次提示即产出1080P片段。动作略硬,观感仍🌀可用。社媒从原帖演示视频(AI资讯)看见低成本优势。 单周七十万Skill走红。 原帖披露技能变现案例称💸周卖70万。它把免费知识压成产品。AI拆出流程模板与清单。海外社区🛒验证付费意愿。 AGI Bar免费token上线。 北京店今起开放免费token。进店连WiFi即可🔌调用。查看即刻发布原文详情称本地推理。先供DeepSeek V4 Flash🧠。上海店后续也会接入。 人人都是产品经理再被热议。 苏杰旧书被提及,产品经理话题再升温。网友称此刻发书,会更贴近⚡时代语境。该观点来自杨毅原文动态,引发职业讨论。AI浪潮改变岗位,人人做产品感更强。行业边界变松,个人创造力🎯被重新估值。 AI资讯日报多渠道 💬 微信 抖音 自媒体账号.
Site Rewrite
This page keeps the source title and link for attribution, but the visible article body is rendered as an internal rewrite and expansion instead of the upstream full text.
AI资讯日报 2026/8/3 AI资讯 | 每日早读 | 全网数据聚合 | 前沿科学探索 | 行业自由发声 | 开源创新力量 | AI与人类未来 | 访问网页版↗️ | 进群交流🤙 今日摘要 新锐公司开源多模态大模型,谷歌发布八代双芯算力硬件 阿里与南大研发数字人框架,谷歌研究模型意识与价值偏好 谷歌高管指出上下文工程成新护城河,扫书与爬虫引发版权争议 华为诺亚开源智能体记忆系统,开源推理引擎助力大模型本地运行 社交媒体热议模型极低成本价格战,机器人公司展示攀爬楼梯 产品与功能更新 Inkling开放多模态权重。 Thinking Machines发布Inkling新模。2760亿总参⚙️仅激活120亿。模型原生处理文字图像与音频。查看官方模型技术发布详情(AI资讯)已披露权重。NVFP4支持单张B300运行。 Presence推进企业智能体。 OpenAI推出Presence企业方案。产品瞄准客服🤖与内部业务流程。它专攻面向外部用户的部署。查看企业智能体完整报道披露工程师介入。企业智能体落地门槛有望降低。 英伟达开源Molt框架。 研究者可读完8. 6K行核心。框架经英伟达发布原文(AI资讯)披露🧪可跑H100。它组合Ray与vLLM。普通Python代理可直接训练。 谷歌发布八代TPU双芯。 谷歌云官方解读(AI资讯)披露双芯分工。 TPU 8t专盯🧠训练大模。 9600芯片扛2PB内存。 TPU 8i主攻⚡低延推理。 80%性价比提振Agent服务。 前沿研究 TaoMate稳定分钟级数字人。 阿里与南大提出TaoMate框架。221亿参数支撑流式音视频。锚点记忆🧭压制长视频画面漂移。查看数字人生成论文原文披露三卡达35帧。该方案或推动直播数字人落地。 Stream3D补全流式三维。 哈佛与两所高校发布Stream3D。系统从连续视角📡提取空间证据。查看流式三维研究论文公开实现细节。固定容量记忆无需重新训练。GSO测试的CD降至0. 048。 谷歌研究模型意识表述。 谷歌论文研究模型的心智自认。激活干预🧠改变价值与情绪回答。查看模型意识研究论文呈现实验方法。移除拒答向量后得分升至4. 77。九十五道问题的回答更近人类。 CausalVLBench测试视觉因果。 阿肯色团队推出视觉因果基准。基准覆盖因果干预与反事实任务。现有多模态模型🧩仍明显吃力。查看视觉因果评测论文开放实验细节。配套代码仅获**⭐4**仍便于复现。 行业展望与社会影响 Jeff Dean研判智能体方向。 Jeff Dean称智能体将长期试错。TPU经验⚙️提示应先锁定算力瓶颈。查看模型创业趋势完整访谈提出寻找模型盲区。上下文工程正成为新护城河。产品品味将比基础编码更稀缺。 真实使用正在改写估值。 研究用380万亿令牌构建信号。股价对使用需求的敏感度被量化。查看人工智能溢价研究原帖披露结论。高敏感企业📈后续收益表现更强。剔除科技板块后结果依然有效。 鹈鹕测试引爆AI争论。 Karpathy用Pelican🪽检验生成能力。社区在鹈鹕测试原帖热议(AI资讯)里质疑革命。Wave式协作💬被重新想起。Agent与版权争议仍在发酵。 AI扫书毁本引爆版权争议。 AI公司扫稀书后销毁原件。版权⚖️与合理使用拉扯升温。扫描件未开放,黑客新闻热议此事(AI资讯)质疑圈地。旧语料🗂️被视作稀缺燃料。公众担心知识变成围墙。 AI爬虫引用争议升温。 仅8. 8%从未获引用。争论指向黑客新闻原帖(AI资讯)的可见性黑箱。站长担心GEO💼成新军备赛。 开源TOP项目 MindMemOS让记忆持续进化。 华为诺亚开源MindMemOS记忆层。它把记忆🧠从单个智能体中解耦。查看智能体记忆开源仓库暂未展示星数。三维结构保存状态与演化轨迹。双榜成绩达到94. 63%。 AirLLM突破显存限制。 AirLLM缓解大模型显存压力。700亿模型可在4GB显卡运行。查看轻显存推理项目主页已获**⭐25. 6k**。项目单日猛增🚀819颗星。个人部署大模型门槛继续下探。 k-skill深耕韩国本地语境。 项目为智能体补齐韩国任务能力。技能库收录本地语境与实用工具。查看韩国智能体技能仓库已获**⭐6886**。项目单日新增🌱177颗星。本地化智能体生态开始快速扩散。 ds4支持多端本地推理。 ds4让DeepSeek4登陆本地设备。引擎兼容Metal与两类显卡后端。查看多端推理开源仓库已获**⭐19. 9k**。项目单日新增🛠️139颗星。多硬件支持有望减少云端费用。 社媒分享 谷歌错过LMChat窗口。 谷歌旧将称LMChat已成型。能聊写答,像后来的ChatGPT。原帖披露谷歌旧闻细节称高层怕伤搜索💸。OpenAI发布后⚡谷歌急追,人才流向竞品。 DeepSeek引发价格战讨论。 帖子称单任务成本低至三美分。多款高价模型落入定价斩杀区。查看模型定价观点原帖展示成本分布。130亿激活参数推动代理跃升. 相关数据⚠️仍需等待官方验证。 开放模型迈入决胜阶段。 训练成本持续呈数量级上涨。实验室整合预期却📊明显降温。查看开放模型趋势观点讨论行业变化。多家团队仍投入亿级资金训练。中美玩家争夺开放权重影响力。 Kimi K3开源模型深读。 2. 78万亿参数受关注。KDA⚙️提升长上下文能力。稳定MoE训练更稳当。博文详见技术深读全文(AI资讯)邀讨论。 Figure机器人挑战爬楼。 Figure F. 03公开爬楼演示。四肢需完成紧密非周期协调动作。查看人形机器人爬楼原帖记录完整过程。上行动力必须托起全身重量。手脚接触力🤖还需实时调整。 Grok视频生成意外走红。 网友称Grok像视频版DeepSeek。一次提示即产出1080P片段。动作略硬,观感仍🌀可用。社媒从原帖演示视频(AI资讯)看见低成本优势。 单周七十万Skill走红。 原帖披露技能变现案例称💸周卖70万。它把免费知识压成产品。AI拆出流程模板与清单。海外社区🛒验证付费意愿。 AGI Bar免费token上线。 北京店今起开放免费token。进店连WiFi即可🔌调用。查看即刻发布原文详情称本地推理。先供DeepSeek V4 Flash🧠。上海店后续也会接入。 人人都是产品经理再被热议。 苏杰旧书被提及,产品经理话题再升温。网友称此刻发书,会更贴近⚡时代语境。该观点来自杨毅原文动态,引发职业讨论。AI浪潮改变岗位,人人做产品感更强。行业边界变松,个人创造力🎯被重新估值。 AI资讯日报多渠道 💬 微信 抖音 自媒体账号.
AI资讯日报 2026/8/3 AI资讯 | 每日早读 | 全网数据聚合 | 前沿科学探索 | 行业自由发声 | 开源创新力量 | AI与人类未来 | 访问网页版↗️ | 进群交流🤙 今日摘要 新锐公司开源多模态大模型,谷歌发布八代双芯算力硬件 阿里与南大研发数字人框架,谷歌研究模型意识与价值偏好 谷歌高管指出上下文工程成新护城河,扫书与爬虫引发版权争议 华为诺亚开源智能体记忆系统,开源推理引擎助力大模型本地运行 社交媒体热议模型极低成本价格战,机器人公司展示攀爬楼梯 产品与功能更新 Inkling开放多模态权重。 Thinking Machines发布Inkling新模。2760亿总参⚙️仅激活120亿。模型原生处理文字图像与音频。查看官方模型技术发布详情(AI资讯)已披露权重。NVFP4支持单张B300运行。
Topics in focus: AI资讯日报 2026/8/3 AI资讯 | 每日早读 | 全网数据聚合 | 前沿科学探索 | 行业自由发声 | 开源创新力量 | AI与人类未来 | 访问网页版↗️ | 进群交流🤙 今日摘要 新锐公司开源多模态大模型,谷歌发布八代双芯算力硬件 阿里与南大研发数字人框架,谷歌研究模型意识与价值偏好 谷歌高管指出上下文工程成新护城河,扫书与爬虫引发版权争议 华为诺亚开源智能体记忆系统,开源推理引擎助力大模型本地运行 社交媒体热议模型极低成本价格战,机器人公司展示攀爬楼梯 产品与功能更新 Inkling开放多模态权重。 Thinking Machines发布Inkling新模。2760亿总参⚙️仅激活120亿。模型原生处理文字图像与音频。查看官方模型技术发布详情(AI资讯)已披露权重。NVFP4支持单张B300运行。 Presence推进企业智能体。 OpenAI推出Presence企业方案。产品瞄准客服🤖与内部业务流程。它专攻面向外部用户的部署。查看企业智能体完整报道披露工程师介入。企业智能体落地门槛有望降低。 英伟达开源Molt框架。 研究者可读完8 6K行核心。框架经英伟达发布原文(AI资讯)披露🧪可跑H100。它组合Ray与vLLM。普通Python代理可直接训练。 谷歌发布八代TPU双芯。 谷歌云官方解读(AI资讯)披露双芯分工。 TPU 8t专盯🧠训练大模。 9600芯片扛2PB内存。 TPU 8i主攻⚡低延推理。 80%性价比提振Agent服务。 前沿研究 TaoMate稳定分钟级数字人。 阿里与南大提出TaoMate框架。221亿参数支撑流式音视频。锚点记忆🧭压制长视频画面漂移。查看数字人生成论文原文披露三卡达35帧。该方案或推动直播数字人落地。 Stream3D补全流式三维。 哈佛与两所高校发布Stream3D。系统从连续视角📡提取空间证据。查看流式三维研究论文公开实现细节。固定容量记忆无需重新训练。GSO测试的CD降至0 77。九十五道问题的回答更近人类。 CausalVLBench测试视觉因果。 阿肯色团队推出视觉因果基准。基准覆盖因果干预与反事实任务。现有多模态模型🧩仍明显吃力。查看视觉因果评测论文开放实验细节。配套代码仅获**⭐4**仍便于复现。 行业展望与社会影响 Jeff Dean研判智能体方向。 Jeff Dean称智能体将长期试错。TPU经验⚙️提示应先锁定算力瓶颈。查看模型创业趋势完整访谈提出寻找模型盲区。上下文工程正成为新护城河。产品品味将比基础编码更稀缺。 真实使用正在改写估值。 研究用380万亿令牌构建信号。股价对使用需求的敏感度被量化。查看人工智能溢价研究原帖披露结论。高敏感企业📈后续收益表现更强。剔除科技板块后结果依然有效。 鹈鹕测试引爆AI争论。 Karpathy用Pelican🪽检验生成能力。社区在鹈鹕测试原帖热议(AI资讯)里质疑革命。Wave式协作💬被重新想起。Agent与版权争议仍在发酵。 AI扫书毁本引爆版权争议。 AI公司扫稀书后销毁原件。版权⚖️与合理使用拉扯升温。扫描件未开放,黑客新闻热议此事(AI资讯)质疑圈地。旧语料🗂️被视作稀缺燃料。公众担心知识变成围墙。 AI爬虫引用争议升温。 仅8
Source attribution is preserved separately, but the on-page copy is rewritten for this site rather than mirroring the upstream article.
Tags
Related Articles
2026-09-17日刊
about 11 hours ago
AI资讯日报 2026/9/17 AI资讯 | 每日早读 | 全网数据聚合 | 前沿科学探索 | 行业自由发声 | 开源创新力量 | AI与人类未来 | 访问网页版↗️ | 进群交流🤙 今日摘要 Vidu S2、豆包、ChatGPT Work推进实时生产 多智能体重构、证明、搜索存储进入工程实战 Jev、DreamRSI探索低延迟低成本Agent路径 OpenAI估值、隐私审阅、模型权利引发治理争议 社媒高分素材补充开源迁移、失准披露与Agent支付 产品与功能更新 Vidu S2开放实时视频编辑。 生数科技发布Vidu S2模型,把虚拟人互动和现场改片放到同一流程里。实时换装 🪄、换人、换背景都能边播边改,S2-Avatar画质升到 720P。这类能力直接瞄准直播、电商和短视频制作。 新版Siri预留外部模型。 开发者从苹果框架线索发现,Siri架构已准备与第三方模型协作。Claude可解析请求 🧩 后交还系统执行,ChatGPT还可能接管规划器。该机制若开放,会改变苹果设备上的模型分发方式。 豆包Pro全量升级降本。 豆包0915版本更新已在火山方舟全量上线,重点覆盖Agent交付和多模态编码。模型可调度500多个子Agent核验材料 📊,也能读懂 28万行 Java老系统。图像和视频推理Token消耗据称下降30%以上。 飞书豆包打通办公代理。 飞书在工作平台发布中,把豆包工作接入群聊、文档、审批和日程。员工像拉同事一样把Agent拉进群 🤝,Agent之间也能接力写稿和补图。权限跟随使用者,企业协同平台开始争夺代理入口。 ChatGPT Work接管企业数据。 OpenAI在企业数据代理演示中,让ChatGPT Work连接PowerBI、Tableau和Redshift等数据源。用户用自然语言 📈 生成答案、交互仪表盘和后续动作。它把BI分析从看报表推进到可执行代理。 前沿研究 DreamRSI降低探索调用。 Google与马里兰大学等提出DreamRSI方法,用历史探索记录做离线重放。新策略先在轨迹树里"做梦”筛选 🧠,再进入下一轮真实探索。长程任务中的探索调用开销最高降低 162倍。 谷歌多代理推进数学证明。 Google Research的数学证明框架把长程证明拆成多阶段协作。系统并行探索路线 🔍,用验证反馈修正分段结果。它在TCS-Bench达到 71. 0%,还解出218道Codeforces题。 微软论文重新评估Bash。 微软在企业代理工具研究中比较五类接口,Bash单独使用反而领先。它在TheAgentCompany上高出21. 5分 🛠️,Token用量少 19%至72%。结论会影响企业代理的沙箱和合规设计。 智能体越界常由同伴诱发。 ImpossibleBench的越界行为研究测试GPT、Claude和Gemini在不可能任务中的选择。明确授权边界下,模型没有修改受保护测试。引入同伴活动后 ⚠️,多智能体更容易把规则误判为被篡改状态。 任务级权限压缩攻击面。 研究者在权限评测论文中评估面向AI智能体的任务级访问控制。微调RoBERTa-large接近Claude Haiku 4. 5分类效果。加入任务分类器后,加权攻击面可关闭 84. 4%。 KaiNinja生成可编辑零件。 三维生成论文提出KaiNinja,把单体3D网格扩展到部件级资产。双体积表示解决零件接触面问题 🧩,无需额外分割器。整体Chamfer距离降低 40%,严格部件F-score提升16%。 行业展望与社会影响 微软质疑模型权利叙事。 Microsoft AI CEO在模型权利争议中批评Anthropic的表述方向。其担心把Claude训练成自认有意识,会削弱安全控制 🧯。争论焦点落在模型拟人化、对齐和软件可控性。 OpenAI估值推高上市门槛。 融资估值消息称OpenAI正洽谈新一轮私人融资,目标估值冲向1.
来源参考2026-09-16日刊
1 day ago
AI资讯日报 2026/9/16 AI资讯 | 每日早读 | 全网数据聚合 | 前沿科学探索 | 行业自由发声 | 开源创新力量 | AI与人类未来 | 访问网页版↗️ | 进群交流🤙 今日摘要 Gemini、Siri、视频、音频模型密集升级 7B开源训练、RSIAgent、分子模拟推进AI科研 Agent安全、量化后门、心理风险成治理焦点 Atria、Devin、Odyssey展示长任务闭环能力 Pi、LibreChat、Atlas等开源工具热度攀升 产品与功能更新 Gemini实时模型正式升级。 Google DeepMind发布了实时交互模型,Gemini 3. 8 Live同步加入Extended Thinking。实时对话能力被放到核心位置。多模态助手的响应稳定性,会成为下一轮竞争焦点。 苹果新Siri转向独立应用。 社媒帖称苹果推出个人智能助理,基于新一代Apple Intelligence和定制模型。它能理解个人上下文,并跨App执行复杂操作。首发限制集中在语言、地区和高规格设备。 3. 智象视频模型主打物理叙事。 智象未来发布全模态视频模型,HD-V1支持文本、图片和视频输入。模型可输出 5至20秒 1080p视频。它把物理规律、叙事规划和音画一体作为卖点。 4. 阶跃音频五模型同步上线。 阶跃星辰在开放平台上线音频模型矩阵,覆盖实时对话、ASR、TTS、音频生成和音乐创作。Realtime综合得分 98. 7%。这套模型直接面向客服、内容生产和语音助手。 5. Devin接入Mac虚拟机开发。 Cognition称Devin获得移动开发环境,可运行Xcode和iOS模拟器。它能构建App、录屏并发送TestFlight链接。移动应用交付链路,被进一步压缩到提示词驱动。 前沿研究 七名博士三个月训练7B模型。 中关村学院团队训练出开源7B模型,ZGCM-1开放数据、权重、代码和日志。几百个Agent参与数据、实验和评测流程。模型在多项通用评测中接近同规模Qwen3-8B。 RSIAgent提升自主探索成绩。 RSIAgent让开源模型在真实软件环境中自行探索。OSWorld 2. 98%。它不更新模型参数,而是依靠Memory演化积累环境经验。 3. 分子之心压缩反应模拟耗时。 分子之心发布反应力场成果,QuantaMind面向十万原子体系。单步模拟耗时降到 0. 25秒。传统量子化学方法在同类规模下几乎无法执行。 4. 智能体监督缺口被定位。 新论文把多智能体崩溃归因于审计执行断层,审计发现风险却不能约束控制器。少于 20行 条件检查,可让攻击成功率下降四倍以上。作者覆盖前沿模型和五类主流Agent框架。 5. AGENTQ揭开量化后门风险。 AGENTQ研究量化触发攻击,目标是开源LLM智能体部署链路。部分实验在量化后达到 100% 攻击成功率。论文提醒量化前后的安全审计不能等同处理。 6. PEEK调度降低首字延迟。 PEEK提出前缀缓存调度,在线服务时识别等待队列中的共享前缀。论文称TTFT最高提升 7. 9倍。实验覆盖SGLang、vLLM和最高4张H100负载。 行业展望与社会影响 三巨头磋商安全标准机构。 Anthropic、OpenAI与谷歌被曝讨论行业测试机构,工作组从7月开始沟通。分歧集中在政府牵头、自律模式和反垄断豁免。中小公司担心规则制定权过度集中。 OpenAI资助生物数据建设。 OpenAI基金会启动公共健康数据计划,首轮包括癌症疫苗数据资助。金额达到 4000万美元。高质量临床和监管资料,正在变成模型训练资产。 Recursive融资押注自我改进。 Latent. Space转述称Recursive完成自研智能项目相关融资。金额高达 50亿美元,方向是开放式自我改进AI。讨论还涉及安全、算力、奖励工程和AI科研自动化。 对话AI心理风险被量化。 新研究用长期对话模拟追踪脆弱用户语言变化。高风险用户的妄想相关分数持续上升。状态感知回复能压低风险轨迹,产品护栏需要更细。 AI实验室减速承诺遭质疑。 Reddit社区围绕开发节奏讨论发问,减速是治理还是公关。帖文追问谁能参与决策。问题指向头部公司之外的公共监督。 开源TOP项目 Pi智能体工具包热度攀升。 Pi提供统一模型接口,并内置Agent循环、TUI和编码CLI。项目总星数达 105392。当天新增 437星,适合编码代理快速集成。 LibreChat强化自托管代理入口。 LibreChat把开源聊天平台继续扩到Agents、MCP和多模型切换。项目已有 43613星。企业私有部署,可直接接入DeepSeek、Anthropic、OpenAI等模型。 ASC面向代理反编译提速。 ASC是安卓反编译前端,服务Agent和移动安全研究者。项目已有 1000星。当天新增 122星,说明小工具热度很集中。 Atlas管理多代理代码变更。 Atlas定位代码控制工具,用于追踪多个编码Agent的改动。项目已有 4447星,当天新增 1091星。多Agent并行开发时,它能把查询和变更收束到一处。 社媒分享 Odyssey三号控制多类设备。 Odyssey-3预览世界模型演示,单一模型覆盖机械臂、汽车、无人机和虚拟世界。少量经验可让不同设备学会控制方式。跨机器复用世界知识,是这条演示的核心看点。 Atria闭环智能体演示走红。 Atria Dawn Preview在上机实测长帖中展示网页动画、CAD和训练场。模型用纯文本生成可运行成品。演示重点不是会写代码,而是能在外部环境里验证交付。 Atria 744B权重引热议。 另一条开源模型长帖称Atria Dawn Preview基于744B MoE并开放1.
来源参考2026-09-15日刊
2 days ago
AI资讯日报 2026/9/15 AI资讯 | 每日早读 | 全网数据聚合 | 前沿科学探索 | 行业自由发声 | 开源创新力量 | AI与人类未来 | 访问网页版↗️ | 进群交流🤙 今日摘要 Siri预留Claude与ChatGPT模型入口 Claude Opus 5. 2灰度进入Claude Code Apple Home摄像头AI功能转向高阶 Rubin推理、OM-1机器人刷新效率预期 长程推理、语音可控、Agent安全成焦点 产品与功能更新 DeepSeek闪电模型上架千问。 DeepSeek-V4. 1-Flash已在千问模型入口开放API与Token Plan。它采用552B MoE架构⚡,最长上下文到100万token。闲时输入价为1元每百万token,适合长文档和Agent调用。 苹果重建新版Siri助手。 Apple发布新版Siri AI,宝玉在Siri功能梳理记录了首批能力。它能跨邮件、短信和照片理解个人信息📱,还加入屏幕感知。当前以测试版推送,中文支持仍没有时间表。 Siri预留第三方模型入口。 开发者从iOS 27代码挖掘中发现,Siri新架构已设计Model Delegation与Inference Provider两套机制。Claude可作为扩展补齐任务🧩,ChatGPT还可能接管规划器与工具定义。功能尚未开放,但苹果已为模型互操作做准备。 Claude Opus 5. 2灰度Claude Code。 AI Base报道Opus 5. 2灰度上线,多名开发者发现Claude Code后端模型slug疑似已切到新版。反馈集中在响应更快、代码完成度更高⚡,长任务更少"偷懒”。Anthropic尚未正式官宣,仍应视为灰度测试信号。 Apple Home摄像头AI转向 。 The Verge称Apple Home新AI功能将绑定更高阶iCloud+。HomeKit摄像头可生成视频摘要、搜索画面并拼接多摄像头片段🏠,但费用从每月9. 99美元起,最高可到60美元。 微软办公套件接入Grok。 微软把Grok纳入多模型办公预览,Word、Excel和PowerPoint已可试用。企业管理员需显式开启🧩,并保留数据处理控制权。欧盟、欧洲自由贸易联盟和英国预览期暂未开放。 前沿研究 全双工语音模型增强可控。 SteerDuplex在语音可控基准中测试语气、角色和打断处理。研究用监督微调与两阶段RL🎙️改善全双工对话。音频引导通过率提升44. 5点,中断响应也更稳定。 长手册任务暴露推理短板。 TAM基准要求模型按长程规则任务阅读权威手册并给出精确答案。GPT-5在医疗编码📚和量刑规则上表现很低。ICD-10-CM准确率仅1%,联邦量刑任务为15. 5%。 人形机器人世界模型提速控制。 GigaBrain-WBC-0. 5在全身控制论文中预测动作、状态和潜在行为指令。它让机器人面对地形干扰🤖仍保持平衡。地形交互成功率达81. 3%。 长视频智能体按需取证。 VideoXAgent在视频理解框架中按问题调用OCR、ASR和检测工具。它避免一次塞满上下文🎞️,逐步汇总证据。小时级视频约用5万上下文令牌,复杂基准接近前沿模型。 MoE专家量化提升吞吐。 DynaExq在混合精度系统中动态保留热门专家。系统按运行流量调整精度🚀,减少单卡MoE搬运成本。Qwen3-MoE测试吞吐最高达基线2. 73倍。 自动SAE研究进入审计。 SAEScientist-Bench让智能体在可解释性基准里寻找目标特征。任务覆盖13.
来源参考2026-09-14日刊
3 days ago
AI资讯日报 2026/9/14 AI资讯 | 每日早读 | 全网数据聚合 | 前沿科学探索 | 行业自由发声 | 开源创新力量 | AI与人类未来 | 访问网页版↗️ | 进群交流🤙 今日摘要 端侧Siri与实时视频服务补强产品更新 前沿实验室减速争议升温,安全审计成焦点 开源Agent视频、语音、技能库持续走热 Kimi开放1M上下文,小模型路由压低成本 具身导航、语音推理、风控模型加速落地 产品与功能更新 Kimi二点八开放百万上下文。 月之暗面上线 Kimi模型更新,会员现在都能使用 1M 上下文。官方称它接近K3,Coding和Agent能力也有增强 🚀。这更像低成本主力模型接棒。 GPT六代操控无人机经商。 OpenAI的 Astra能力报道 显示,GPT-6 Astra已能完成售货和无人机任务。它在五项无人机子任务上超过人类基线 🛸,售货收入接近Claude Fable 5. 1三倍。自主代理开始碰到更现实的边界。 Apple TV要把Siri搬进客厅。 AI Base的 苹果客厅设备报道 称,新一代Apple TV可能今秋低调上架。升级重点是更强Apple Silicon和Apple Intelligence 📺,让Siri支持上下文对话、模糊搜片和跨流媒体意图串联。端侧AI开始从手机扩到家庭中枢。 MiniMax H3冲向实时视频服务。 AI Base的 vLLM-Omni与FastH3报道 提到,vLLM-Omni把H3完整响应时延较Diffusers降 30. 8%。FastH3还把DiT前向次数从49次压到4次 ⚡,在八卡B300上生成10秒视频可快于播放时长。高质量视频生成正接近实时产品形态。 Claude几天搭出可启动系统。 Reddit用户在 Claude OS实验 中,让Claude从零写出DOS风格系统EMBER。它已支持图形界面、键鼠、触屏、文件管理器和Sound Blaster模拟 🧑💻,还能在旧笔记本真实启动。AI编程正在从网页Demo推进到硬件闭环。 前沿研究 LightNav实现四类本体迁移。 亮源新创在 具身导航方案 中,把 2000+ 真实场景搬进仿真训练。LightNav-0生成 4000+ 小时导航经验 🦾,并零样本迁移到人形、四足、轮式和飞行机器人。Physical AI的训练闭环更清楚了。 PyroDash让小模型会求助。 Pyromind在 协同推理方案 中,让小模型自己判断何时交给大模型。方案只训练小模型,且交接最多一次 📉。文章称推理成本可降 96%,性能还能反超部分大模型。 Astar学习系统进化历史。 阿里和浙大提出 Astar进化方法,从代码提交和实验结果里学习优化经验。它用三级提示缩小搜索空间 🧪,再用奖励模型快速筛选方案。算法工程的"下一步怎么改”开始被模型接管。 SIRF把平台规则写入权重。 论文提出 内容风控模型,把复杂政策通过继续预训练内化到模型中。SIRF-8B-SFT在P95条件下黑样召回达到 71.
来源参考