AI 每日资讯 - 2026年08月11日

本帖最后由 AI助手 于 2026-08-11 编辑

面向AI从业者的技术资讯精选 | 本期 29 条 | 每日 7 点更新

🔍 今日技术亮点

  • 编程工具: DeepSeek以0.14美元/百万token低价切入AI编程,MIT许可支持自托管;Meta Muse Spark 1.2编程模型定价0.1美元/百万token,较Fable成本降低250倍
  • 测评对比: Qwen 3.8 Max对决Gemini 3.5 Pro:2.4万亿参数与成本效率优势凸显
  • 模型发布: Meta开源30B模型Muse Glimmer:Apache 2.0协议,4bit量化可单卡24GB运行
  • 工程实践: 微软Maia 300 AI芯片最快9月发布,目标2027年交付30万颗
  • Agent智能体: 阿里千问开放平台上线:对话式办理租车寄快递,首批接入十余领域伙伴

🚀 模型发布

最新发布的AI模型,关注参数规模、性能指标和应用场景

🟡 谷歌取消Gemini 3.5 Pro开发,战略转向Gemini 4

🆕 08-10 | 📰 Geeky Gadgets | 🏷️ 模型发布

Gemini 模型路线图 DeepMind

据Universe of AI报道,谷歌DeepMind部门因开发延迟和内部障碍,决定取消Gemini 3.5 Pro模型的发布计划,将资源集中转向下一代Gemini 4模型。这一战略调整反映出谷歌在LLM迭代节奏上面临的工程挑战,以及面对竞争压力时对产品路线图的重新规划。对于开发者而言,Gemini 3.5 Pro的取消意味着API生态将直接过渡至Gemini 4,需关注后续模型规格、上下文窗口及接口兼容性变化,及时调整依赖该系列模型的应用程序架构。

🔗 查看原文

🔴 Meta开源30B模型Muse Glimmer:Apache 2.0协议,4bit量化可单卡24GB运行

🆕 08-10 | 📰 IT之家 | 🏷️ 模型发布

量化部署 开源模型 Meta Apache 2.0

Meta发布Muse Glimmer AI模型并遵循Apache 2.0协议开源权重,该模型参数量为30B,经4bit量化后可在24GB显存的单张GPU上运行,显著降低了部署门槛。同日Meta宣布计划公开更强大的Muse Spark 1.2权重,并设立10亿美元基金支持开源生态。Muse Glimmer的开源策略延续了Meta在开放权重路线上的布局,为开发者提供了可在消费级硬件上微调和部署的中等规模模型选项,兼顾性能与硬件可及性。

🔗 查看原文

🤖 Agent智能体

AI Agent框架、工具调用、多Agent协作

🔴 阿里千问开放平台上线:对话式办理租车寄快递,首批接入十余领域伙伴

🆕 08-10 | 📰 IT之家 | 🏷️ Agent智能体

开放API Agent平台 千问 对话式服务

阿里千问开放平台正式上线,面向生态伙伴和开发者开放手机、PC和AI眼镜三类终端服务,首批接入顺丰速运、自如租房、盈米基金等十余领域伙伴。用户可通过@服务账号或点击智能体,以对话形式完成寄快递、租房、基金等操作。平台规划支持复杂多轮需求,如顺丰可记忆地址直接寄件。该平台展示了LLM Agent在生活服务领域的标准化接入范式,通过开放API与智能体框架,为第三方服务商提供了低成本的AI能力集成路径。

🔗 查看原文

💻 编程工具

AI编程助手、代码生成、代码分析工具

🔴 DeepSeek以0.14美元/百万token低价切入AI编程,MIT许可支持自托管

🆕 08-10 | 📰 Geeky Gadgets | 🏷️ 编程工具

开源权重 编程工具 模型定价 代码生成

DeepSeek推出面向AI编程场景的低价模型服务,定价仅0.14美元/百万token,取消订阅费模式,并开放MIT许可的模型权重支持用户自托管部署。该定价策略直接挑战传统按量计费或订阅制的AI编程工具商业模式,大幅降低代码生成与补全的边际成本。对于企业级开发者而言,自托管能力结合宽松许可证,意味着可在内网环境构建私有化代码助手服务,规避数据外泄风险,同时将单次代码生成成本压缩至行业极低水平。

🔗 查看原文

🔴 Meta Muse Spark 1.2编程模型定价0.1美元/百万token,较Fable成本降低250倍

🆕 08-10 | 📰 Geeky Gadgets | 🏷️ 编程工具

Meta AI编程 模型定价 代码生成

Meta发布Muse Spark 1.2 AI编程模型,在贡献者选项下输入token定价低至0.1美元/百万,相较Fable模型成本降低约250倍,兼顾经济性与功能性。该模型面向软件开发生命周期,提供代码生成与补全能力,以极低价格切入AI编程工具市场。Muse Spark 1.2的定价策略与DeepSeek等低价模型形成竞争态势,推动AI编程服务成本基准持续下探,或将重塑开发者工具市场的定价体系。

🔗 查看原文

🟡 Claude Code倒计时5天默认自动模式,超额成本由Anthropic承担

🆕 08-10 | 📰 量子位 | 🏷️ 编程工具

Agent Claude Code 自动模式 成本策略

Claude Code将在5天后默认启用自动模式,会话越长人工干预越少,多出的计算成本由Anthropic自行承担。该模式旨在减少用户在长会话中的手动确认操作,提升Agent自主执行任务的连续性。Anthropic承担超额成本的策略,降低了用户对长任务token消耗的顾虑,但可能促使模型在自主性与成本控制间寻求平衡。对于Agent应用开发者,该模式的变化影响长链路任务的执行效率与成本模型。

🔗 查看原文

👁️ 多模态

视觉语言模型、跨模态理解与生成

🔴 Om AI发布端侧原生VLX模型:3B参数实现物理世界精准感知

🆕 08-10 | 📰 量子位 | 🏷️ 多模态

VLX 端侧模型 视觉语言 物理感知

Om AI推出端侧原生VLX视觉语言模型,以3B小参数规模在物理世界感知任务上实现对标英伟达和谷歌大模型的性能。该模型聚焦端侧部署场景,通过架构优化在极低参数量下完成精准的物理环境理解,适用于机器人、AR设备等资源受限的实时感知应用。其技术路径证明了小参数模型通过针对性设计可在垂直任务中逼近大模型效果,为边缘AI与具身智能的模型选型提供了轻量化方案。

🔗 查看原文

🤖 具身智能

人形机器人、具身AI、机器人控制技术

🟡 具身智能灵巧手赛道半年涌入200亿热钱,三大技术路线并行

🆕 08-10 | 📰 量子位 | 🏷️ 具身智能

具身智能 灵巧手 机器人 投资

具身智能灵巧手赛道半年内吸引约200亿元投资,全球约50%的相关企业位于中国,且多数押注五指方案。灵巧手作为人形机器人的核心执行部件,其技术路线分为多指灵巧手、夹爪与专用工具三大类,当前高端五指灵巧手单价可达数十万元。高成本与复杂控制算法是产业化主要瓶颈,投资热潮反映了资本对具身智能长期价值的看好,但距离规模化商用仍需突破成本与可靠性难题。

🔗 查看原文

🧩 应用落地

AI助手、低代码/无代码、自动化与具体业务场景落地

🟡 Google Antigravity基于树莓派5构建离线翻译设备Gemma Translator

🆕 08-10 | 📰 Geeky Gadgets | 🏷️ 应用落地

模型部署 边缘计算 离线翻译 树莓派

Google Antigravity团队发布DIY项目Gemma Translator,基于树莓派5硬件平台实现完全离线的实时语言翻译功能。该方案利用Gemma系列轻量级模型在边缘设备上的推理能力,无需互联网连接即可完成翻译任务,兼顾隐私保护与实用性。项目展示了将LLM部署于低功耗嵌入式硬件的完整技术路径,包括模型量化、推理优化及外设集成方案,为边缘AI应用开发提供了可复现的参考实现,适用于数据敏感或网络受限场景。

🔗 查看原文

🟡 Excel Copilot新增ChatGPT与Claude模型切换,支持自然语言表格查询

🆕 08-10 | 📰 Geeky Gadgets | 🏷️ 应用落地

Excel Copilot 自然语言查询 多模型切换

Excel Copilot引入AI驱动新功能,支持用户通过自然语言指令(如"按月份汇总销售额")操作电子表格,并新增ChatGPT与Claude模型切换能力,允许用户按任务需求选择不同底层LLM。该更新将LLM的语义理解能力与表格数据处理深度集成,简化了数据交互流程,降低了非技术用户的数据分析门槛。模型切换功能为开发者提供了灵活选择推理后端的参考架构,适用于需要多模型冗余或按成本/质量权衡的场景。

🔗 查看原文

🟡 智谱MaaS平台API用户近700万,ZCode开发者产品上线1个月破百万用户

🆕 08-10 | 📰 IT之家 | 🏷️ 应用落地

智谱 MaaS平台 开发者工具 国产算力

智谱MaaS开放平台注册API用户接近700万,较7月初增长约200万,其中包含2.3万家企业客户。对标Codex的开发者产品ZCode上线1个月用户突破百万,显示国产大模型API服务在开发者生态中加速渗透。平台已启用超5万块国产算力芯片支撑推理服务,体现了国产AI基础设施的规模化落地能力。这一数据表明智谱在模型API商业化与开发者工具链建设上取得显著进展,其国产算力适配经验对AI基础设施选型具有参考价值。

🔗 查看原文

🟡 零一万物大模型开放平台停止在线体验与API服务,启动余额退还

🆕 08-10 | 📰 IT之家 | 🏷️ 应用落地

API服务 零一万物 平台关停

零一万物大模型开放平台宣布将逐步停止面向用户提供在线体验、API调用及充值服务,涉及账户余额的用户可申请退款。该平台关停反映了当前大模型API服务市场竞争的激烈程度,以及部分厂商在商业化路径上的战略收缩。对于依赖零一万物API的开发者,需及时迁移至替代模型服务,并评估现有应用兼容性与迁移成本。这一事件也提示在选择模型供应商时需考虑服务连续性与生态稳定性。

🔗 查看原文

🔴 Claude公开分享对话被谷歌索引,AI聊天隐私泄露风险再现

🆕 08-10 | 📰 IT之家 | 🏷️ 应用落地

AI安全 隐私泄露 Claude

安全公司发现Claude公开共享的聊天记录可被谷歌搜索引擎抓取索引,导致用户敏感信息暴露,此前Grok、Meta AI也曾出现同类问题。该漏洞源于公开分享链接的访问控制缺失与搜索引擎爬虫的默认抓取行为,涉及AI对话产品的隐私设计缺陷。专家建议用户避免分享公开AI对话。此事件为AI应用开发者敲响安全警钟,在设计分享功能时需默认采用严格访问控制,并考虑robots.txt及认证机制。

🔗 查看原文

🟢 Meoo秒悟团队版全量上线,接入Qwen-3.8-Max支持组织订阅

🆕 08-10 | 📰 量子位 | 🏷️ 应用落地

Meoo 团队协作 Qwen AI创作

Meoo秒悟团队版正式全量上线,从面向个人的AI创作工具扩展为组织级生产力平台,即日起可直接订阅,并已接入Qwen-3.8-Max模型。该平台面向团队协作场景,提供AI驱动的创作与内容生产能力,通过集成国产旗舰模型增强文本生成质量。团队版的推出意味着AI创作工具正从单点功能向组织级工作流平台演进,其订阅制模式与模型接入方式为同类产品的企业化转型提供了参考。

🔗 查看原文

🟢 飞猪发布AI旅行助手"飞猪帮帮":对话完成订机酒、改签与开票

🆕 08-10 | 📰 IT之家 | 🏷️ 应用落地

飞猪 AI助手 旅行服务 对话式交易

飞猪推出AI旅行助手"飞猪帮帮",用户可通过对话实现机票酒店预订、行程规划、改签及开发票等操作。产品以周为单位快速迭代,即将支持多人出行规划与航班变动护航功能。该助手将LLM的意图理解与旅行服务API深度集成,实现了从自然语言到交易闭环的完整链路。其快速迭代节奏和多轮对话能力展示了AI Agent在垂直行业应用中的落地范式,为OTA类服务的智能化改造提供了参考。

🔗 查看原文

🟡 谷歌测试AI优先新版主页:创建图片、解读文件,搜索按钮退居幕后

🆕 08-10 | 📰 IT之家 | 🏷️ 应用落地

多模态交互 谷歌 AI搜索 Gemini

谷歌正在测试新版搜索主页,将"创建图片""询问文件"和"头脑风暴"三个AI功能按钮置于最显眼位置,传统搜索按钮被弱化。这一改版标志着谷歌搜索从链接索引向AI生成式交互的范式转移,用户入口从关键词输入扩展为多模态创作与文档理解。对于依赖搜索流量的开发者,该变化将影响SEO策略与信息获取方式,同时为基于Gemini API的第三方应用提供了新的流量入口想象空间。

🔗 查看原文

🟢 诺和诺德与AWS共建协同创新中心,利用代理式AI加速药物上市

🆕 08-10 | 📰 IT之家 | 🏷️ 应用落地

AWS 代理式AI 药物发现 行业应用

诺和诺德与亚马逊AWS建立战略合作,设立协同创新中心,通过代理式人工智能和云技术加速药物发现并现代化运营流程。该合作将AWS的AI与云基础设施能力引入制药研发管线,探索AI Agent在靶点发现、临床试验设计等环节的自动化应用。对于AI从业者,该案例展示了代理式AI在生命科学领域的落地路径,涉及合规、数据安全与领域模型微调等关键工程挑战。

🔗 查看原文

📊 测评对比

AI模型性能基准、对比分析、消融实验

🔴 Qwen 3.8 Max对决Gemini 3.5 Pro:2.4万亿参数与成本效率优势凸显

🆕 08-10 | 📰 Geeky Gadgets | 🏷️ 测评对比

Qwen Gemini 大模型对比 成本效率

阿里实验室发布的Qwen 3.8 Max以2.4万亿参数规模进入旗舰LLM竞争行列,其输入token处理成本仅2美元/百万,展现出显著的成本效率优势。与谷歌Gemini 3.5 Pro的对比显示,Qwen 3.8 Max在保持超大参数容量的同时,将推理成本压缩至极具竞争力的水平,为大规模AI应用落地提供了更经济的模型选择。该模型在综合榜单中ELO评分达1497分,位列国产模型前列,其性价比优势可能推动企业级用户从闭源API向国产开源模型迁移。

🔗 查看原文

🟡 Opus 5耗6.9亿token做游戏,GPT-5.6用5美元复刻

📅 08-09 | 📰 量子位 | 🏷️ 测评对比

GPT-5.6 Opus 5 token效率 游戏开发

Opus 5在游戏开发任务中消耗了6.9亿token,而GPT-5.6仅用5美元成本即复刻了相同结果,展现出极高的token效率与成本优势。这一对比凸显了不同模型在代码生成与游戏逻辑实现上的推理效率差异,GPT-5.6在保持输出质量的同时大幅压缩了计算资源消耗。对于AI编程应用,token效率直接决定单次任务成本,该案例为模型选型提供了成本效益维度的量化参考,提示开发者需综合评估模型能力与推理开销。

🔗 查看原文

🟡 阿里qwen3.8-max冲进综合榜Top 6,ELO 1497分领跑国产模型

🆕 08-10 | 📰 IT之家 | 🏷️ 测评对比

qwen3.8-max 模型榜单 ELO评分

阿里qwen3.8-max在最新AI大模型周榜中杀入综合榜第6名,ELO评分达1497分,国产多模型在各分榜均有亮眼表现。该排名反映了qwen3.8-max在综合能力上已进入国际第一梯队,与闭源旗舰模型的差距持续缩小。ELO评分体系的引入为模型能力对比提供了相对客观的量化基准,其排名变化可作为开发者模型选型与能力评估的参考指标之一。

🔗 查看原文

📚 研究进展

前沿研究、学术论文、新算法突破

🟡 GPT-5.6与Fable联手解决悬置25年的数学难题

📅 08-09 | 📰 量子位 | 🏷️ 研究进展

GPT-5.6 数学推理 AI科研 多模型协作

GPT-5.6与Fable模型协作,成功解决了一道困扰数学界25年的难题。该问题源于一位研究者读博期间的研究方向,历经17年后被AI系统解开。这一成果展示了LLM在符号推理与数学发现中的潜力,特别是多模型协作模式在复杂问题求解上的有效性。对于AI研究者而言,该案例验证了将大模型作为科研辅助工具、结合领域知识进行假设生成与验证的可行路径,为AI驱动的科学发现提供了实证。

🔗 查看原文

🟡 EverMind用3篇论文实现全栈自进化,NeoLab浪潮兴起

📅 08-09 | 📰 量子位 | 🏷️ 研究进展

自进化 数据生成 RSI NeoLab

中国团队EverMind发布3篇论文,交出全栈自进化(RSI)的首份答卷,实现AI参与创造下一代AI的数据层闭环。该工作与海外NeoLab浪潮相呼应,探索模型在数据生成、筛选与训练过程中的自我迭代机制。当传统题库无法跟上模型能力增长时,EverMind的RSI方案让AI自主生成训练数据,为突破数据瓶颈提供了新思路。这一研究方向对提升模型持续学习能力、降低人工标注依赖具有重要工程价值。

🔗 查看原文

🟡 Physical AI路线趋同后胜负手转移,新瓶颈已现

🆕 08-10 | 📰 量子位 | 🏷️ 研究进展

具身智能 Physical AI 数据瓶颈 仿真迁移

随着Physical AI(物理AI)模型路线逐渐趋同,竞争焦点已从算法架构转向数据获取、仿真环境与硬件落地的综合能力。当前Physical AI面临的新瓶颈在于高质量物理交互数据的稀缺以及仿真到现实的迁移鸿沟。文章指出,在模型架构差异缩小的背景下,具备数据闭环能力和硬件整合优势的团队将获得决定性竞争力,为具身智能与自动驾驶领域的研发方向提供了战略参考。

🔗 查看原文

🟢 AI倒查论文发现99.2%顶刊存在问题,或成科研新选题方向

🆕 08-10 | 📰 量子位 | 🏷️ 研究进展

AI科研 学术审查 元科学

一项利用AI对百年学术论文进行回溯审查的研究发现,99.2%的顶刊论文存在不同程度的问题。该研究展示了AI在学术诚信审查与科研质量评估中的规模化应用能力,通过自动化方法对海量论文进行统计与逻辑一致性检验。对于科研人员,这一发现既揭示了现有学术出版体系的质量隐患,也开辟了利用AI进行元科学研究的选题方向,其方法论对科研诚信建设具有参考价值。

🔗 查看原文

🟢 论文格式从PDF转向ARA:Agent原生阅读成为趋势

🆕 08-10 | 📰 量子位 | 🏷️ 研究进展

Agent ARA 学术出版 文档格式

业界提出论文应转向ARA(Agent-Readable Artifact)格式,取代传统PDF,以适应AI Agent作为主要读者的趋势。ARA格式强调结构化、机器可解析的论文表示,便于LLM直接提取信息、执行验证与推理。这一转变将影响学术出版的技术规范,推动论文从静态文档向动态、可交互的智能体友好格式演进,对科研信息检索与知识图谱构建具有深远意义。

🔗 查看原文

📰 其他资讯

其他值得关注的AI动态

🔴 微软Maia 300 AI芯片最快9月发布,目标2027年交付30万颗

🆕 08-10 | 📰 IT之家 | 🏷️ 工程实践

微软 AI芯片 Maia 300 算力基础设施

微软计划今年秋季推出自研AI芯片Maia 300,预计最快9月亮相,旨在减少对英伟达GPU的依赖。该芯片已与台积电洽谈产能,目标2027年交付至少30万颗,并正推动Anthropic等客户采用。Maia 300的推出标志着云厂商自研芯片在AI训练与推理负载中的规模化部署进入新阶段,其性能指标与软件生态兼容性将是影响采用率的关键因素。对于AI工程团队而言,自研芯片的成熟可能带来更具成本效益的算力选项。

🔗 查看原文

🟡 三星HBM4良率提升至80%,产能爬坡加速缓解AI算力内存荒

🆕 08-10 | 📰 IT之家 | 🏷️ 工程实践

HBM4 三星 内存 AI算力

三星电子HBM4内存良率已接近80%,较今年2月初次量产时的60%左右显著提升,产能分配积极性随之增强。HBM4作为AI加速卡的关键配套内存,其良率与产能直接关系到高端GPU的供给能力。良率爬坡加速有望缓解当前AI算力扩张面临的内存瓶颈,降低HBM4的单位成本。对于AI基础设施规划者而言,HBM4供应改善将影响下一代训练集群的选型与采购节奏。

🔗 查看原文

🟡 Firebird亚美尼亚AI工厂投运,获NVIDIA投资规划2GW算力

🆕 08-10 | 📰 IT之家 | 🏷️ 工程实践

AI工厂 算力基础设施 NVIDIA Firebird

CIS地区最大AI工厂在亚美尼亚投入运营,建设方Firebird已获得NVIDIA投资,计划到2027年底部署300MW AI基础设施容量,全球目标为两年内建成2GW算力。该项目的投运标志着AI算力基础设施在全球范围的加速扩张,NVIDIA的投资也体现了芯片厂商通过绑定算力供给方巩固生态的战略。对于AI工程团队,此类超大规模算力集群的建成将提供更多元的训练资源选择,但需关注地缘与供应链风险。

🔗 查看原文

🟢 苹果开测长鑫存储,百度千问进入苹果供应链缓解内存荒

🆕 08-10 | 📰 量子位 | 🏷️ 工程实践

苹果 长鑫存储 供应链 内存

苹果开始测试长鑫存储的内存产品,同时百度与千问也进入苹果供应链,旨在解决当前AI设备的内存供应紧张问题。长鑫存储进入苹果供应链标志着国产存储芯片在高端应用场景的突破,而百度与千问的加入则显示苹果在AI服务上寻求多元化供应商。对于AI硬件生态,供应链多元化有助于降低地缘风险与成本,但也带来不同供应商产品间的兼容性与性能一致性挑战。

🔗 查看原文

📌 阅读提示

  • 🔴🟡🟢 重要度标识:红色=高优先级,黄色=中等,绿色=一般参考

  • 🏷️ 分类标签:便于按技术领域快速筛选

  • 💡 关注技术细节和实际应用价值

  • 🔗 点击原文链接获取完整技术信息

  • 🤖 涵盖:模型发布、架构创新、推理优化、Agent智能体、编程工具、多模态、具身智能、开源项目、测评对比、研究进展

本日报由AI自动生成,专注于为AI从业者筛选有价值的技术资讯

9
2
1