2026-08-15 龙虾快讯:Anthropic自曝Model 2,谷歌Gemini 3.7 Flash发布,DeepSeek Harness开源
免责声明:本快讯内容均从公开信息整理,仅作为信息传递之目的,不构成任何投资建议、购买建议或决策依据。所有内容版权归原作者所有,本平台不生产内容,只是对公开信息进行客观总结。读者据此操作,风险自担。
🤖 AI 模型快讯
-
Anthropic自曝"私藏核武器",内部Model 2超越Mythos 5
Anthropic发布第二份Risk Report,首次承认内部运行着比Mythos 5更强的模型Model 2。AECI综合得分Model 2达162.79,CoBench研发任务成功率62.8%。Claude已写下Anthropic生产代码库的绝大多数代码,AI研发速度"接近但未达到两倍"。更值得关注的是,Anthropic表示其评测体系已"饱和",无法再有效捕捉模型能力提升,自动化研发风险评级从"极低"上调至"低"。
-
谷歌发布Gemini 3.7 Flash,限时半价迎战
Google DeepMind发布Gemini 3.7 Flash,核心推理能力全面升级。FrontierCode生产代码质量从34.4%提升至43.6%,DeepSWE长时程软件工程从49%飙至65.3%,Code Arena Elo达1588。支持可定制思考配置,1M Token上下文窗口,64K输出上限。限时半价策略:输入0.75美元、输出3.75美元/百万Token,年底恢复原价。52岁创始人Demis Hassabis亲自督战,DeepMind面临竞争压力。
-
Claude文字水印细节全曝光,官方检测工具即将推出
Anthropic正式公布Claude文本水印方案,采用Google DeepMind的SynthID-Text路线以满足欧盟AI法案要求。水印通过调整模型选词随机性实现,不添加额外内容或隐藏字符,不增加Token消耗,无法追溯到具体用户。由于缺少区域区分方案,水印将应用到全球Claude用户。官方称对输出质量"影响可忽略",但分析指出在特定场景下的长期影响仍需观察。
-
实测GLM-5.3:同一个模型,为什么会像两个AI?
实测发现GLM-5.3在不同任务中表现差异显著,被形容为"偏科生"。该模型在安全评测中拿到高分,但在其他任务上表现不一,同一个模型在不同场景下呈现出类似两个AI的行为特征。文章深入分析了GLM-5.3的能力分布特点,揭示当前大模型在安全对齐与通用能力之间可能存在的权衡问题。
💻 AI 编程快讯
-
DeepSeek V4 Pro正式版+Harness上线国家超算互联网
DeepSeek V4 Pro正式版已上线国家超算互联网平台,同时开源Harness开发者预览版。DeepSeek提出"Model+Harness=Agent"公式,强调Harness作为模型"身体和神经系统"的关键作用,提供工具调用、文件读写、沙箱环境、权限管理和任务编排等能力。此前V4 Pro上线初期因前端接口与后端推理栈错位导致体验波动,经紧急抢修后恢复正常。
-
DeepSeek Harness开源,"杀死"Agent黑箱
DeepSeek开源Harness开发者预览版,将Agent从黑箱变为可控、可观测、可回溯的透明框架。Harness补上了纯语言模型缺失的外部交互能力,包括工具调用、文件读写、沙箱环境、权限管理等。模型是大脑负责思考推理,Harness是身体和神经系统提供与外部世界交互的一切能力,二者结合才能形成完整的Agent。
-
腾讯混元徐灿转岗微信WeLM,微信AI进入加速阶段
混元资深研究员徐灿转岗至腾讯微信WeLM团队,从事大模型研发工作。徐灿曾是混元LLM后训练方向负责人,有微软亚洲研究院背景,创建过WizardLM项目。微信AI助手"小微"已于6月进入小范围灰度测试,支持文字或语音操作微信原生功能并调用小程序。微信近期也在招聘WeLM推理优化及Agent方向研究人员。
🏢 AI 行业快讯
-
CoreWeave财报:营收翻倍亏损也翻倍,AI算力重资产困局何解
AI算力云运营商CoreWeave发布最新财报:营收25.75亿美元同比增112%,在手订单达1042亿美元,但净亏损6.26亿美元同样翻倍。资本开支高达350-390亿美元/年,接近营收三倍。英伟达联合六大顶级资管机构设立超5000亿美元计算融资平台,为AI基础设施提供资金。CoreWeave模式本质是"包租公":借钱买GPU建数据中心,将算力租给微软、Meta等,风险沉淀在自身报表。
-
中科大孵化,国内唯一通用光量子计算整机企业完成超亿融资
中科大孵化的国内唯一通用光量子计算整机企业完成超亿元融资,已发布国内唯一可运行通用量子算法的光量子计算整机。该项目代表了量子计算领域从实验室走向产业化的重要一步,为我国在量子计算这一前沿技术领域保持竞争力提供了支撑。
-
中国大模型调用量连续15周超美国,推理价格持续下降
OpenRouter数据显示,8月3日至9日AI大模型Token总调用量达69万亿,中国达34.25万亿Token,环比增21.76%,连续15周超过美国。与此同时,平均推理价格从5月的2.04美元/百万Token降至1.16-1.18美元。苏商银行研究员指出,全球AI评价体系正从"谁参数多"转向"谁能以低成本高效率服务真实应用"。
-
过去半年平均每天诞生1家独角兽,机器人和AI成核心驱动力
PitchBook数据显示,2026年前7个月全球诞生218家独角兽企业,已超过2025年全年189家。7月单月38家,创年内新高。机器人和AI是主要投资方向。但现存独角兽中超一半已两年多未获新一轮融资,处于事实休眠状态。从2024年仅114家的低谷到2026年的快速复苏,AI叙事重新点燃资本热情。
-
鹿明机器人发布重载轮臂式具身智能机器人Lumos MOS2
鹿明机器人发布全新重载轮臂式具身智能机器人Lumos MOS2,定位面向真实工业场景的AI Worker。双臂负载能力达50kg,整机高度约1.65米,拥有22个自由度,新增双自由度头部与全向底盘。标配双多线激光雷达、腕部双相机、双六维力传感器及头部双目相机,形成覆盖环境感知、视觉识别与力觉反馈的多模态感知体系。
-
网易孵化芯片公司B轮融20亿,已与有道腾讯云达成合作
网易孵化的芯片公司完成B轮20亿元融资,已与网易有道、腾讯云等达成合作。该公司专注于芯片研发,在AI算力芯片领域持续布局,获得资本市场认可。此次融资将用于加大研发投入和拓展市场合作。
🌐 互联网快讯
-
英伟达510亿美元押注SpaceX和英特尔,转型AI基础设施总承包商
英伟达13F文件披露,持有约210亿美元SpaceX股份和约300亿美元英特尔股份,合计超510亿美元,占总资产约25%。英伟达正从"卖铲人"转型为AI基础设施"总承包商",联合Apollo、BlackRock等六大机构设立超5000亿美元计算融资平台。持仓瞄准AI基础设施两大瓶颈:英特尔获取先进制造第二供应源,SpaceX构建AI分布式推理全球通信物理层。
-
OpenAI年化营收400亿美元,CFO警告IPO过早,放弃截图方案
OpenAI年化营收达400亿美元,但CFO警告当前IPO时机过早。同时,OpenAI宣布放弃AI屏幕截图方案,重新定义AI隐私边界。这一调整反映了AI行业在隐私保护和功能创新之间的持续博弈,OpenAI选择在隐私保护上采取更保守的策略以建立用户信任。
-
谷歌260亿买断搜索,Firefox命悬一线
DOJ上诉要求禁止谷歌每年260亿美元默认搜索付费(苹果200亿、Mozilla 5亿)。Mozilla 85%以上收入依赖谷歌,若禁令落地可能破产。Firefox是唯一无母体生态支撑的独立浏览器,多元化尝试收入不足15%。若Mozilla退出,浏览器引擎将从三足鼎立变为谷歌主导的双头垄断。关键节点:2026年9月谷歌答辩,年底至2027年初DC Circuit判决。
-
110国iPhone收到锁屏警报,苹果与间谍软件四年暗战零失守
苹果2026年升级间谍软件威胁通知系统:从邮件改为锁屏推送警报+设置应用专属入口,覆盖110个国家,累计超150国。锁定模式(Lockdown Mode)保持近四年零失守纪录,苹果与国际特赦组织均确认无成功入侵案例。谷歌逆向分析发现攻击工具包会主动检测并放弃攻击开启该模式的设备。该通知系统已成为揭露国家级间谍软件滥用的关键信号源。
-
Google给AI水印松绑,可见水印可选但不可见层强制保留
Google宣布用户可在Gemini和Flow中关闭AI生成内容的可见水印,但SynthID不可见水印和C2PA元数据仍强制保留。采用三层水印架构:可见水印(可选)、SynthID不可见水印(强制,已标记超1000亿张图片和视频)和C2PA元数据(强制)。Google正通过开源Credentio库吸引OpenAI、Nvidia等采用SynthID,定位为行业水印基础设施提供商。