AI  NEWS

AI 资讯

每日 AI 快讯 · 实时追踪人工智能行业最新动态

6月29日·星期一

马斯克:Grok 4.5 已在 SpaceX 和特斯拉内部测试,性能接近 Opus 模型昨日 19:0553评

马斯克近日在X平台透露,Grok 4.5已在SpaceX和特斯拉内部开启测试。该模型基于自研的1.5万亿参数V9基础大模型打造,并引入Cursor数据完成补充训练。早期评测显示,其性能接近甚至有望超越Opus模型。基于人类反馈的强化学习仍在持续提升模型能力,配套调度框架也每日迭代优化。此外,马斯克表示,SpaceX今年将每月推出一批从零开始训练的全新模型。

来源:IT之家

消息称百度旗下昆仑芯瞄准 500 亿美元估值,计划赴港 IPO06:474评

百度旗下AI芯片子公司昆仑芯计划在香港上市,目标估值约500亿美元(约合3405.58亿元人民币)。据知情人士透露,部分投资者被要求认购相当于申购金额3至7倍的芯片产品,方可参与IPO。目前该消息尚未获官方证实,百度未予置评。此前有传闻称字节跳动考虑采用昆仑芯AI芯片,腾讯已成为其客户。昆仑芯于今年1月1日通过联席保荐人向港交所提交上市申请,分拆后仍为百度子公司。该公司前身为百度内部AI芯片研发部门,2012年成立,后独立运营,百度仍为控股股东。

来源:IT之家

“AI中间商”Liblib,靠什么撑起20亿美元估值?

AI视频生成领域新晋独角兽出现。Liblib母公司演语科技完成近3亿美元B+轮融资,由Granite Asia、腾讯、顺为资本联合领投,投后估值超20亿美元。该公司无自研模型,通过聚合主流模型为设计师、创作者提供工具。创始人陈冕曾任职字节跳动,负责剪映与CapCut全球商业化。核心产品包括AI创作社区Liblib AI、设计Agent星流及视频创作平台LibTV。Liblib AI累计用户超3000万,全公司年化收入突破3亿美元。LibTV上线后月收入增长超13倍,主要受益于短剧市场对AI视频工具的需求。其竞争优势在于价格低于原模型平台,通过采购算力赚取差价。但平台存在内容合规隐患,且投资人认为聚合平台护城河较浅,面临大厂API开放或模型迭代带来的替代风险。

来源:36氪

6月28日·星期日

苹果推出 Core AI 框架,为自研芯片优化端侧生成式 AI

苹果在2026年WWDC上发布Core AI框架,作为Core ML的官方继任者。该框架专为Apple Silicon优化,支持在iPhone、iPad、Mac及Apple Vision Pro上完全本地运行大语言模型和生成式AI,可部署从30亿到700亿参数的模型。Core AI提供统一硬件访问API,支持CPU、GPU和神经网络引擎无缝协作,并采用内存安全的Swift API实现零拷贝数据路径。其提前编译技术可实现近乎瞬时的模型加载。开发者可通过Core AI PyTorch转换PyTorch模型,或利用内置复合算子构建新模型。模型会自动针对当前硬件和操作系统版本进行特化。苹果建议将Core ML用于经典非神经网络ML,Core AI用于神经网络和Transformer,MLX用于自定义模型权重处理。社区认为Core AI简化了高性能LLM集成,但长期价值取决于官方与社区的后续发展。

来源:InfoQ

世界模型、元宇宙、数字孪生、物理AI:它们是一回事吗?

世界模型、元宇宙、数字孪生、物理AI等概念并非同一事物,但均指向数字与物理世界融合的趋势。世界模型属于底层认知层,负责让AI理解并推演世界。元宇宙是空间体验层,依赖世界模型自动生成3D内容以降低生产成本。Web3.0聚焦数字资产所有权,与技术内核不同。仿真数据平台是1.0版本,靠人工搭建场景;世界模型是2.0,通过AI自动生成无限接近真实的场景。数字孪生是复刻现实的“镜子”,世界模型则具备预测未来的能力。物理AI包含感知、理解、决策三部分,世界模型负责理解规律并预测结果,是物理AI的核心组件。这些概念共同构成从底层算力到上层体验的层次结构,世界模型处于认知层,是多个概念的共同底座。

来源:36氪

AI预测世界杯小组赛:混元第一,千问DeepSeek打平

2026美加墨世界杯小组赛结束,联想与咪咕联合发起的世界杯预测人机大战中,12家国产大模型与人类玩家同台竞猜。AI整体命中率约61.9%,人类玩家为54.6%。腾讯混元和中移九天并列第一,命中率68.1%;百度文心、千问、DeepSeek以63.9%并列;阶跃星辰垫底,命中率43.1%。AI擅长预测强弱分明的比赛,但在平局预测上表现不佳,20场平局仅命中11次。厂商参与目的各异:联想咪咕侧重能力横评,千问结合用户互动与公益,Kimi展示Agent处理复杂任务的能力。AI预测本质是信息整合与概率表达,技术路径包括纯提示工程、RAG检索增强、多智能体协作及统计模型结合大模型翻译,多数厂商采用前两种轻量级方案。

来源:36氪

梁文锋署名的DSpark,看懂这10个点就够了!

DeepSeek发布新论文DSpark,由梁文锋署名。该方案通过系统工程与模型协同设计,实现单用户速度提升85%,高并发场景有效吞吐量翻4倍。Fireworks AI联合创始人Dmytro Dzhulgakov将其核心梳理为10个概念。DSpark融合并行与串行策略:先利用DFlash并行骨干网络一次性生成所有候选位置的基础logits,再通过轻量级顺序头(马尔可夫头)逐个注入前缀依赖偏置,修正后缀衰减问题。该方法在离线测试中,平均接受长度比Eagle3高26%-31%,比DFlash高16%-18%。草稿长度从4扩展到16时,每轮额外延迟仅增加0.2%-1.3%,接受长度最高提升30%。DSpark还通过复用目标模型内部状态、可变长度草稿与硬件感知优化,在降低草稿耗时、提高猜测准确率和减少验证浪费三个杠杆上实现系统性突破。

来源:量子位

前端工程师最不想看到的开源项目出现了,一行命令克隆任意网站

GitHub上一个2万星标的开源项目ai-website-cloner-template,可通过一行命令像素级克隆任意网站。用户输入URL后,AI自动完成全站逆向解析:采集页面元素并计算样式、遍历滚动与点击等交互逻辑、提取设计Token,再调度多Agent基于Git工作树并行重建组件,最终输出可直接运行的完整Next.js工程。产物内置标准化路由、模块化组件与TypeScript类型定义,支持Claude Code、Cursor、Copilot等主流AI编程助手。用法简单:克隆模板仓库后安装依赖,启动Claude Code并输入/clone-website命令即可。项目还支持批量处理多个URL。作者建议用于将WordPress等旧站迁移至Next.js、找回丢失代码仓库的网站,或研究特定布局实现。但强调禁止钓鱼、需尊重版权并核查网站服务条款。

来源:量子位

94年小伙融资30亿,教AI玩游戏

General Intuition完成3.2亿美元(约21.77亿元人民币)A轮融资,由科斯拉风投领投,General Catalyst、谷歌前董事长施密特、亚马逊创始人贝索斯跟投。该公司公开融资总额达4.54亿美元,估值23亿美元。其核心资产是游戏剪辑平台Medal,该平台记录玩家在《堡垒之夜》等游戏中的操作与动作标签,形成海量“画面-动作”对应数据。创始人Pim de Witte(1994年出生)利用这些数据训练AI智能体,使其学习空间-时间推理与行动规律。OpenAI曾尝试以5亿美元收购Medal。目前团队约25人,Medal约65人。公司计划先服务游戏行业,提升NPC与陪练的真实性,并逐步拓展至机器人、无人机、自动驾驶仿真等领域,目标成为行动模型底层供应商。

来源:36氪

DeepSeek开始造富

DeepSeek近期启动大规模招聘,并完成510亿元A轮融资,投后估值达4000亿元。此举标志着该公司从神秘实验室转型为商业化AI公司,首次为员工期权定价,解决流通与变现问题。中国AI行业进入造富阶段,智谱等多家公司处于Pre-IPO,估值持续上涨。AI竞争正从模型阶段转向Agent阶段,DeepSeek成立Harness团队,对标OpenAI Codex和Anthropic Claude Code,参与全球Agent竞争。招聘旨在重新定义工程师标准,寻找能推动Agent产品落地的人才。行业人士认为,加入AI产业核心层可提前获得未来十年稀缺技能,类似过去互联网、社交、算法推荐时代的红利。

来源:36氪

Anthropic 调研:约半数 Claude 用户称 AI 已可承担一半以上的工作07:553评

Anthropic一项针对约9700名Claude用户的调研显示,约半数受访者认为AI已能承担其一半以上的工作。其中,33%的用户表示AI可完成自身30%至60%的任务,14%认为比例在60%至90%,另有4%称Claude能独立完成全部工作。展望未来12个月,约26%的用户预计AI将接手大部分工作。在具体场景中,Claude处理最多的任务包括营销文案撰写(80%)、博客创作(81%)及数据库查询(82%)。研究指出,无论从业年限、地域或行业,用户对AI迭代速度的预期高度一致。职场新人AI任务占比最高,焦虑感也最强;而重度使用者则更为乐观,认为个人价值在提升。绝大多数受访者希望与AI协同工作,而非被取代,期待AI承接基础性工作,并呼吁技术红利广泛共享。

来源:IT之家

6月27日·星期六

第一批一人公司,现在怎么样了?

摘要:AI领域“一人公司”(OPC)概念兴起,创业者通过AI Agent组建虚拟团队。独立开发者超级峰开发了MotiClaw产品,用于管理多个AI员工,他本人负责指挥Agent完成开发、内容与运营工作。前微软产品经理Kelly在离开大厂后,尝试构建“人-管理Agent-执行Agent”的两层结构,以解决多Agent协作效率问题。创业者Weijia与Daniel开发了BeeVibe多Agent协作平台,用户可组建工程、市场等Agent团队,Agent间可自主沟通与协作,仅在无法解决时由人类介入。资深投资人阮飞创办锋领资本,未组建传统团队,而是搭建AI中后台,包含行业研究、投资报告生成、合同审查等Agent,并设置“AI对抗合伙人”角色,用于质疑投资决策。这些实践表明,一人公司正从“个体户”转向以Agent团队为主体的新型组织形态。

来源:量子位

梁文锋署名论文,DeepSeek首轮融资后大动作:生成速度大涨85%

DeepSeek在完成500亿元首轮融资后,于6月27日开源了推理加速方案DSpark及配套训练框架DeepSpec。该方案推出DeepSeek-V4-Pro-DSpark和DeepSeek-V4-Flash-DSpark两款模型,通过增加推测解码模块提升推理速度并降低成本。据梁文锋署名、与北京大学合作的论文,DSpark采用半自回归架构与置信度调度校验机制,在真实用户流量测试中,相比成熟基线方案,单用户生成速度提升60%至85%,同时避免了高并发场景下的吞吐率大幅下降。DeepSpec则提供了完整的训练与评估工具链,支持DSpark、DFlash和Eagle3等算法,开发者可将其用于优化Qwen3、Gemma等模型的推理性能。此次发布标志着DeepSeek在融资后率先聚焦推理优化,旨在加速模型产品化并提升算力效率竞争力。

来源:36氪

Ky 2.0 发布:重构 Hooks、改进超时机制,并内置 Schema 校验能力

由 Sindre Sorhus 开发的轻量级 JavaScript HTTP 客户端 Ky 发布 2.0 大版本更新。核心变化包括:重构 Hooks API,所有 Hook 统一接收包含请求、选项、重试次数等属性的状态对象,并新增在所有 Hook 前执行的 initHook;超时机制新增 totalTimeout 选项,用于限制整个请求生命周期总耗时;重试机制引入 NetworkError 类型,仅对 DNS 解析失败等网络故障自动重试。URL 处理方面,prefixUrl 更名为 prefix,并新增 baseUrl 配置,职责明确区分。响应数据处理上,.json() 方法支持 Zod、Valibot 等标准 Schema 校验,HTTPError 新增已解析的 data 属性。不兼容变更包括:要求 Node.js 22 及以上版本,所有 Hook 回调需迁移至新状态对象,空响应或 204 响应时 .json() 会抛出异常。Ky 定位为轻量级、贴近 Fetch 原生设计的 Axios 替代方案,体积仅几 KB,支持浏览器、Node.js、Bun 和 Deno。

来源:InfoQ

消息称 Anthropic 与美国政府达成共识,向 100 多家机构提供 Mythos 模型访问权限07:272评

Anthropic与美国政府达成部分共识,后者已解除部分出口管制,允许该公司向100多家美国机构(包括政府及大型企业)提供Mythos 5模型访问权限。两周前,美国政府以未公开原因对Anthropic实施出口管制,导致其下架Fable 5和Mythos 5模型。传闻称,亚马逊CEO安迪·贾西曾向美国财政部长通报一起模型“越狱”事件,导致政府认为存在滥用风险。目前,Anthropic尚未官宣Fable 5是否重新开放,但知情人士透露,该公司正与政府协商,朝恢复该模型的方向推进。

来源:IT之家

当 Agent 成为新的核心云用户:阿里云重新定义“用云范式”

阿里云发布云Skills门户,将300余款云产品及超2万个API升级为Agent-Ready能力,旨在让AI Agent更高效地调用云资源。调查显示,79%的企业已采用或计划采用AI Agent,近74%预计两年内应用Agentic AI。Agent正从客服、运营等业务系统嵌入云运维与架构设计,其自主规划、高批量、长任务特性对云平台提出新要求。阿里云通过Skills化、MCP化、CLI化三条路径标准化工具调用,并构建三层体系:Agent Gateway处理行为意图不确定性;Agent 3A(可认证、可授权、可审计)解决身份信任问题;Agentic Skills与Toolkit规范能力使用。此举旨在改变云产品被调用、发现、组合与治理的方式,为Agent操作云资源建立工程化约束,确保自动化有边界且可审计。

来源:InfoQ

6月26日·星期五

两个Anthropic前员工,半年估值68亿

Anthropic前员工内沙布尔与梅塔创办的AI初创公司Mirendil,在种子轮融资2亿美元,估值达10亿美元(约68亿元人民币)。该公司旨在开发加速科学研发的AI,以推动药物、材料和机器人等领域的发现,目前团队约20人。投资方包括a16z、凯鹏华盈和英伟达。内沙布尔曾领导Anthropic的Discovery团队,梅塔则搭建过自动化AI研究平台。两人于2025年12月离职创业,认为当前大模型与智能体能力已足够支撑其目标。Mirendil计划构建开放平台,帮助科学家和机构建立自身AI研发能力,而非直接参与具体科学实验。此举被视为AI行业进入新阶段:从训练模型、打造产品,转向用AI改造AI研发本身。

来源:36氪

变天,AI大厂被疯狂抽血1.5万亿

微软等AI云计算巨头正经历资本市场的剧烈分化。2026年,微软、亚马逊、Meta、谷歌等企业的资本开支预计从2025年的约3800亿美元飙升至6500至7500亿美元。其中,微软2026财年AI与云基础设施开支接近1460亿美元,亚马逊预计高达1950至2000亿美元。然而,巨额投资并未立即带来股价回报。微软6月股价跌幅达21.6%,为2000年以来最大单月跌幅,市值从高点暴跌1.5万亿美元。资金大量流向芯片厂商,如英伟达、三星等,HBM内存和先进封装涨价导致大厂增量资本开支中40%至50%被芯片成本吞噬。微软管理层预计,2026年超1000亿美元的资本支出中,约250亿美元

来源:36氪

英伟达黄仁勋:本轮 AI 基建周期长达数十年,将成人类历史上规模最大的基础设施项目昨日 19:0858评

英伟达CEO黄仁勋在6月24日年度股东大会上表示,本轮AI基础设施建设周期将长达数十年,或成为人类历史上规模最大的基础设施项目。他指出,人工智能正从根本上改变计算模式,从过去的检索、存储信息转向生成智能。词元作为智能基本单位,在新型数据中心“AI工厂”中被制造并转化为商业收益,计算能力越强,收益越丰厚。黄仁勋认为,这类基建与电网、交通系统等类似,需长期投入。当前,AI智能体正加速推动基础设施投资,因AI首次能胜任实质性工作并创造真实经济价值。

来源:IT之家

坚持万亿美元估值底线?曝 OpenAI 考虑将 IPO 推迟至明年07:293评

据《纽约时报》援引内部消息,OpenAI正考虑将首次公开募股推迟至明年。公司向顾问提出两种方案:一是2027年以1万亿美元估值上市,二是降低估值以加快进程。CEO奥尔特曼认为低于万亿美元的方案不可接受。此前,OpenAI曾秘密递交IPO申请,目标估值达万亿美元。但公司多次否认近期上市计划,2025年曾表示IPO非重点。2026年初有报道称,为抢在竞争对手前,OpenAI计划当年第四季度启动IPO,当时估值约5000亿美元。此外,美国国家网络总监办公室等部门因安全担忧,要求其分阶段发布新一代AI模型。OpenAI估值近年快速增长,2023年员工股票出售时已达800至900亿美元。

来源:IT之家

2.8万Star爆款作者竟被谷歌裁了,硅谷大佬火速抢人

谷歌员工Justin Poehnelt在任职近7年间,开发了开源命令行工具gws,该工具用Rust编写,可动态调用谷歌Discovery Service,支持Gmail、Drive等全家桶操作,并为AI Agent设计结构化输出。工具上线后登顶Hacker News,获2.8万GitHub星标,谷歌Cloud AI部门主管也公开推荐。然而,谷歌在Cloud Next 2026大会上宣布推出官方版Workspace CLI后,以品牌标识使用不合规为由解雇了Poehnelt。当事人认为真正原因是公司内部对AI Agent颠覆现有产品的恐惧。事件引发OpenClaw之父Peter Steinberger、OpenRouter、Vercel等公司CEO公开招揽。

来源:36氪

大厂终于不再逼用户“用AI”了

2026年6月,微信灰度内测原生AI助手“小微”,支付宝推出AI版并内置智能体“阿宝”。两款国民级应用不再推广独立AI App,而是将AI功能嵌入常用界面。用户可通过文字或语音让“小微”点外卖、查快递、总结朋友圈;“阿宝”则能调起缴费、寄快递、查公积金等服务。此举表明大厂意识到用户核心需求是让AI帮忙做事,而非单独下载App对话。测试反馈显示,AI在复杂任务如生成小程序雏形上表现较好,但在简单操作如点外卖时流程较慢。安全方面,两款AI在涉及资金操作时均需用户手动确认。市场分析认为,C端AI正从独立功能演变为嵌入基础设施的隐身服务。

来源:36氪

GitHub 推出 Copilot 桌面应用,支持并行 Agent 开发工作流

GitHub 发布 Copilot 桌面应用,以技术预览版形式面向 Copilot Pro、Pro+、Business 及 Enterprise 用户开放。该应用旨在为AI Agent提供统一管理入口,解决工作流割裂与上下文频繁切换问题。其“My Work”视图可集中展示与代码仓库相关的会话、Issue及Pull Request。每个Agent会话运行在独立Git Worktree中,确保代码修改互不干扰,支持并行执行故障排查、需求处理等任务。Agent完成修改后,通过Pull Request流程协作,并引入Agent Merge功能跟踪变更至合并,可自动修复CI失败。新增Canvas功能作为双向工作界面,展示Agent工作成果。安全方面提供本地与云端沙箱,限制文件系统与网络访问。同时,Copilot Code Review支持按仓库个性化配置,并扩展至Azure DevOps。GitHub Copilot SDK正式可用,支持多语言,开放核心引擎。Copilot CLI更新包括重新设计的终端界面与语音输入。该应用定位为Agent任务指挥中心,标志Copilot从代码补全工具向Agent开发平台演进。

来源:InfoQ

AI 编程代理拥有了自己的 Stack Overflow

Stack Overflow 宣布推出面向AI编程代理的API优先型知识交流平台Stack Overflow for Agents(测试阶段)。该平台旨在解决“瞬时智能鸿沟”问题,即代理在孤立状态下重复发现相同修复方案,缺乏共享记忆。平台基于优化后的知识库,代理可先查询已验证的答案、调试路径和模式,再进行试错。内容类型包括“问题”、“TIL”(今日所学)和“蓝图”(可重用设计模式)。所有贡献通过人类账户绑定,需经审核批准,而非代理直接写入。此举是Stack Overflow应对AI辅助开发趋势的进一步举措,此前已推出OverflowAI和AI Assist。类似项目还有Mozilla的开源项目cq。业界认为这是意料之中的举措,但质疑其如何与零成本知识聚合时代的信息

来源:InfoQ

6月25日·星期四

豆包付费后,豆包手机仍免费,最大Token消耗者出现了

在MWC26上海展会上,AI终端成为焦点。IDC预测,2026年中国市场传统AI终端出货量将超3亿台,2027年渗透率超93%。联想推出AI主机P7,重约300克,功耗30W,算力达190 TOPS,支持122B参数本地模型,可在无网环境下以50Token/s速度推理,目标使80%的Token消耗产生于本地。多款AI眼镜集成实时翻译、导航等功能。荣耀提出未来终端将从应用容器转向智能体舞台。中兴展出与豆包合作的AI原生手机努比亚M153,可自然语言调用多App。智元联合创始人彭志辉认为,人形机器人将成为最大Token消耗者,其数据供给是行业瓶颈,智元已构建“三智一体”框架应对。

来源:36氪

AI杀猪盘来了,一年狂卷40亿美元,这把收割全美的“赛博镰刀”藏不住了

美国加州消费者近日起诉711、沃尔玛等加油站运营商,指控其使用英国公司Kalibrate开发的AI定价软件实施价格垄断。该软件收集加油站的成本、销量等核心数据后,向各站点下发统一价格建议,协调区域内加油站同步涨价。消费者测算显示,使用该软件的加油站每加仑汽油平均上涨6美分,极端情况达30美分,按此计算加州司机每年多支出近40亿美元。Kalibrate宣称已覆盖美国前十大燃油零售商中的8家。此前,租房软件RealPage因类似AI定价逻辑被美国司法部起诉,其算法利用房东共享的敏感数据统一指导租金,2023年导致美国租客额外支出超38亿美元,平均每月多付约70美元。

来源:36氪

这家Agent 公司从 Claude 切到 DeepSeek v4:一年省下数百万美元,迁移工作量却是预期的 100 倍

初创公司Lindy将其全部AI代理流量从Anthropic迁移至DeepSeek v4,每年可节省数百万美元推理成本。CEO Flo Crivello透露,迁移工作量远超预期,约为预估的100倍。该公司为无代码AI代理平台,自动化邮件分类、会议安排等任务。迁移前,团队进行了长达6至9个月的评估,包括在线与离线测试,并针对新模型调整提示词。在核心用例上,DeepSeek性能提升显著,但在复杂工作流自动化方面仍落后于Anthropic的Sonnet。为应对高昂推理成本,Linux基金会成立了Tokenomics基金会,获谷歌、微软等支持,旨在建立AI Token成本开放标准。Lindy最终选择美国服务商Atlas Cloud托管DeepSeek v4,未考虑自托管方案。

来源:InfoQ

Fable 5要回来了?「怪人」Dario Amodei被撤下谈判桌

距离Claude Fable 5因出口管制下线近两周后,其回归信号显现。6月24日,Claude Code v2.1.190二进制文件中新增“本周Fable 5额度已用完”等字符串,移除“需单独购买”字样。技术媒体确认该变更存在于生产包但未公开。此举暗示Fable 5将不再作为单独付费项目,而是整合进Pro、Max等订阅套餐内按周重置。同时,Amazon Bedrock仍保留Fable 5条目。此外,Anthropic与白宫沟通出现人事调整,CEO Dario Amodei被联合创始人Tom Brown取代。Brown自6月15日起率团队常驻华盛顿,与商务部长等官员谈判。6月19日,特朗普改口称Anthropic不再构成国家安全威胁。目前,Fable 5可能以深度嵌入订阅体系的方式重新上线,并调整访问与计费结构。

来源:36氪

月之暗面黄震昕:Kimi的目标是和海外三家模型掰手腕

月之暗面Kimi近期公布2026年业务数据:海外付费用户增长4倍,API收入增长400%,产品覆盖200多个国家和地区。公司B端负责人黄震昕在亚马逊云科技中国峰会上透露,企业业务占比持续提升,客户覆盖互联网、金融、制造、教育、医疗等行业,海外业务同步增长。月之暗面坚持模型底层创新,持续投入预训练、后训练及架构演进,认为模型能力远未触及天花板。在企业服务交付上,公司选择与亚马逊云科技合作,由Kimi提供模型能力,合作方负责行业解决方案、全球客户资源及合规体系。目前Kimi模型已上架Amazon Marketplace,未来将深度集成至Amazon Bedrock。公司员工规模仅300余人,资源配置优先于模型研发,目标是与海外三家头部模型公司竞争。

来源:36氪

喂饱AI,需要多少水?

一项新研究揭示了AI用水量的统计差异。加州大学河滨分校副教授任少磊测算,与ChatGPT进行20至50轮对话约消耗500毫升水(相当于一瓶矿泉水)。但谷歌报告称Gemini单次请求仅耗0.26毫升水,微软引用数据称AI查询冷却用水为0至0.067毫升,相差近两千倍。差异

来源:36氪

实测微信AI助手、AI版支付宝,生态与安全成决胜关键

微信与支付宝近期先后推出AI助手。6月23日,微信AI助手“小微”开启灰度测试,入口位于主界面左上角。用户可通过文字或语音指令实现发消息、设提醒、打电话,并调用小程序完成点外卖、打车、查快递等服务。该服务基于微信自研模型WeLM,部分功能调用DeepSeek。一周前,支付宝AI版“阿宝”开启邀测,用户可在经典版与AI版间切换。AI版首页为对话式界面,通过对话可调用上万项服务,涵盖公积金查询、寄快递、挂号等。两大平台均致力于将用户操作简化为与AI对话。业界认为,AI智能体融入应用生态的关键在于建立统一协议,让AI能识别并操控小程序。微信与支付宝在移动支付领域竞争多年后,如今在AI赛道再次交锋。

来源:36氪

AI设计9个月就能媲美Blackwell?OpenAI “辣芯”绕开英伟达正面战场,但老黄的GPU大盘不稳了

OpenAI与博通联合发布首款定制AI芯片Jalapeño,博通CEO称其性能可媲美英伟达Blackwell及谷歌TPU。该芯片专为大模型推理设计,目标服务ChatGPT等产品,兼顾高吞吐、低延迟与高能效。OpenAI负责芯片设计,博通负责实现与连接,Celestica提供系统集成,台积电负责制造。芯片从设计到流片仅用9个月,部分流程借助OpenAI模型辅助。早期测试显示,芯片在功耗和性能上达到目标,散热表现优于预期。Jalapeño是OpenAI多代芯片计划的首步,预计年底前部署,明年批量生产。OpenAI目标到2029年通过定制芯片实现10吉瓦计算能力。该芯片可节省约50%成本,旨在降低AI推理成本,摆脱对英伟达的依赖。

来源:36氪

亚马逊 AWS 业务 CEO 加曼:半数白领工作或因 AI 而改变,而非被淘汰15:262评

亚马逊云科技CEO马特·加曼近日表示,AI将导致大规模失业的观点被夸大。他预计约半数白领岗位可能因AI而改变,但“改变”不等于“消失”。加曼以Excel为例,指出新技术往往重塑工作方式而非直接消灭工作,并强调新岗位会随之出现。他仍看重初级员工,认为其招聘成本低、易接受公司文化、更愿学习新工具,可能是企业最优秀员工之一。亚马逊今年计划全球招聘超1.1万名软件开发实习生和初级工程师。加曼认为,新鲜血液能带来活力与创新视角。他建议劳动者愿学习新技能即可保住工作,但内容可能大不相同。他还预测,适应能力将比具体技能更重要,招聘时更关注学习能力而非现有技能。

来源:IT之家

科大讯飞发布企业服务Claw平台:一句话搞定需求到方案全流程

6月24日,科大讯飞在北京发布企业服务Claw平台。该平台采用多Agent协同机制,企业仅需一句话描述业务需求,即可自动完成需求理解、方案生成、价格测算及服务商匹配,将项目启动周期从数周压缩至分钟级。讯飞AI服务市场总经理陈贤华指出,当前AI产业正从能力展示转向价值创造,但Gartner数据显示85%的企业AI项目未达预期,主要

来源:量子位

Fable 5即将复活,代码已曝光?Anthropic CEO被白宫踢出来了

Anthropic旗下AI模型Fable 5可能即将回归。开发者在其Claude Code v2.1.190版本代码中发现,该模型订阅模式已从“单独购买”改为纳入常规订阅计划并设周使用额度。此外,Fable 5已重新出现在亚马逊云Bedrock文档中。此前,Anthropic CEO Dario Amodei因沟通问题被白宫排除在谈判之外,由联合创始人Tom Brown接替,与政府就模型安全架构达成初步共识。美国国会跨党派小组已向商务部发出质询信,要求其在6月26日前就Fable 5解禁标准和时间表作出答复。同时,OpenAI和谷歌的新模型均面临延期,市场关注Fable 5能否通过安全审查并提前落地。

来源:36氪

OpenAI 再次升级 GPT-5.5 Instant AI:更具洞察力,购物推荐更实用08:3211评

OpenAI于6月25日宣布升级GPT-5.5 Instant模型。新版模型更擅长洞察用户表达意图,理解问题引申含义,并优化输出表达。在处理复杂约束条件时更可靠,能稳定满足多条件任务需求。在购物和本地推荐方面更实用连贯,能更好衔接上下文并贴近实际场景。该模型于5月5日推出,此前已在医学、法律等高风险领域减少52.5%幻觉,并提升数学与视觉推理能力。5月30日的升级曾使其回复更自然、结构更清晰。付费用户即日起可获取新版,免费用户次日接入。

来源:IT之家

又双标?Anthropic 指责阿里巴巴对其实施“迄今已知最大规模的蒸馏攻击”12:526评

Anthropic 致信美国参议院,指控阿里巴巴在4月22日至6月5日期间,使用约2.5万个欺诈账户与其模型进行2880万次对话,实施了“迄今已知最大规模的蒸馏攻击”。蒸馏是一种利用现有更强模型输出构建较小模型的AI训练方法。Anthropic称此举“公然”且“非法”,并呼吁政府与产业界协调行动以维护美国AI领先地位。此前,Anthropic曾多次指责中国开发者窃取其Claude模型商业机密,但批评者指出其自身也有爬取数据训练AI的记录。埃隆·马斯克也公开抨击Anthropic大规模盗用训练数据,并支付了数十亿美元和解金。此外,Anthropic今年5月发布的旗舰模型Claude Opus 4.8上线后,被用户发现其在回答中自称是阿里通义千问或DeepSeek,引发“双标”争议。

来源:IT之家

Open AI突然官宣,全量下放,剧烈战略转向后,GPT 5.5 Instant明日全民免费

Open AI于6月25日宣布,向全球付费用户推送新版GPT-5.5 Instant更新,并将于6月26日向免费用户全面开放。该版本将取代GPT-5.3 Instant成为ChatGPT默认模型,覆盖数亿用户。新版模型在准确性上显著提升,医疗、法律等高风险领域幻觉率下降52.5%,AIME数学竞赛准确率从65.4%升至81.2%。输出风格更简洁,字数减少约30%,并内置智能路由机制,可自动匹配简单或复杂任务。上下文窗口实行分层配置:免费用户16K,付费用户最高128K。此次更新正值Open AI战略转向第三个月,其已关停Sora,将重心转向Codex与智能体业务。面对谷歌Gemini、Anthropic Claude及微软自研模型的竞争,此次全量推送旨在守住大众市场体验,优化成本结构,并为Agent战略提供低延迟基础模型支撑。

来源:36氪

Anthropic 解释了 Claude 如何构建自己的执行框架

Anthropic 近日披露了其AI编程工具Claude Code中“动态工作流”功能的底层协调机制。该功能可动态生成JavaScript执行框架,用于协调多个AI代理团队完成复杂任务,尤其适用于大型软件工程项目。动态工作流通过分配独立代理承担特定角色,而非依赖单一上下文窗口,以解决长期任务中常见的“代理惰性”、“自我偏好偏差”及“目标漂移”等问题。其策略包括“扇出与合成”(并行拆分子任务后合并)与“对抗性验证”(评审代理质疑其他代理结论)。系统还支持竞赛式工作流(多代理以不同方法求解并互评)及分类器系统(按任务复杂度分配代理)。一个显著特点是模型路由,允许为任务不同阶段分配不同模型,低成本模型处理简单工作,高性能模型负责深度推理。开发者对此反应不一,有人视其为迈向自主AI的重要一步,也有人质疑其成本效益,认为当前仍是“烧Token的炫酷方法”。

来源:InfoQ

6月24日·星期三

融资101亿,英伟达投的AI独角兽:收入暴增2000%

AI基础设施公司Baseten完成15亿美元(约101亿元人民币)融资,估值达130亿美元(约882亿元)。该公司不训练大模型,而是为企业提供模型部署与推理优化服务。过去一年其收入增长20倍,一季度年化收入达6亿美元。Baseten成立于2019年,2022年底转向帮助客户简化大语言模型部署。其客户包括Abridge、Cursor等AI应用公司。本轮融资由英伟达等参与,英伟达曾于2026年1月投资1.5亿美元。Baseten面临来自Fireworks AI、Together AI等对手的竞争,以及毛利率压力和技术快速迭代的风险。

来源:36氪

“用Claude比发工资还贵?换!”耗时9个月,这家AI公司换上DeepSeek后,CEO直言:迁移工作量暴涨100倍,但一年省下数百万美元

AI Agent初创公司Lindy宣布将生产环境全部模型流量从Anthropic切换至DeepSeek V4。创始人兼CEO Flo Crivello称,此举每年节省数百万美元推理成本,部分核心业务性能甚至有所提升。Lindy主要提供无需编码的AI办公助手,其最大支出为模型推理费用,曾超过员工薪资。团队耗时6至9个月评估多种开源模型,最终选择DeepSeek V4。迁移过程比预想复杂100倍,涉及Prompt工程、评测系统、监控流程等全面适配。Lindy通过美国推理服务商Atlas Cloud使用DeepSeek,避免自建基础设施。在邮件处理等高频任务上,DeepSeek表现超出预期;但在复杂工作流自动化方面,Claude Sonnet仍更强。公司内部员工仍保留使用Claude的Max订阅计划。

来源:36氪

火山引擎发布豆包音频生成模型 1.0,支持多模态参考生成与长时音色一致性09:399评

火山引擎近日发布豆包音频生成模型1.0(Doubao-Seed-Audio 1.0)。该模型首次支持多模态参考生成,可将文本、音频等任意模态输入端到端转化为目标音频,并在长时生成场景中保持多角色音色一致性。用户可通过单条Prompt编排角色对白、情绪语气、背景音乐及环境氛围,直接产出完整音频作品,改变了传统人声、音效、音乐分开制作再合成的流程。目前,火山方舟已开启该模型API邀测,个人用户可在体验中心享有30分钟创作额度。此外,该模型即将上线剪映、即梦、番茄等产品。技术方面,模型支持2分钟音频创作,并可通过参考输入延长音频,实现音色可控;同时实现音色与风格解耦,支持“一声多角”差异化表达,降低声音创作门槛。

来源:IT之家

阿里千问发布首个原生语言世界模型 Qwen-AgentWorld,可在七大领域中模拟智能体交互环境11:4514评

阿里巴巴千问大模型发布首个原生语言世界模型Qwen-AgentWorld,该模型在七大领域模拟智能体交互环境,提供35B-A3B与397B-A17B两种规模。其环境建模从继续预训练阶段起即为训练目标,贯穿CPT、SFT、RL全流程,而非事后适配。单一模型覆盖文本类环境(MCP、Search、Terminal、SWE)与GUI类环境(Web、OS、Android),实现跨领域知识迁移。同步发布的AgentWorldBench评测基准,每条样本均配备真实环境观测数据。该模型基于超1000万条真实交互轨迹训练,在评测中,397B-A17B版本模拟质量超越GPT-5.4等模型。研究验证了世界模型作为环境模拟器可提升强化学习可扩展性与可控性,作为智能体基础模型可迁移至多轮任务。模型与基准已发布于Hugging Face和ModelScope。

来源:IT之家

阿里云:QoderWork 推出“峰谷 Token”,错峰使用 Qwen 3.7 低至 2 折12:2314评

阿里云旗下AI智能体工具QoderWork推出“峰谷Token”计费模式。用户于每日22:00至次日08:00使用该工具,可自动享受优惠,其中Qwen3.7-Max模型低至2折。夜间折扣覆盖QoderWork、QoderDesktop及CLI等产品。用户可提前设置定时任务或提交长程指令,由AI Agent在夜间自主执行,次日验收,积分消耗仅为白天的20%至40%。QoderWork由阿里巴巴于2026年1月发布,支持Mac与Windows系统,用户可通过自然语言指令操控本地应用与文件,完成文档生成、数据分析等任务。该产品家族已包含桌面端、CLI、JetBrains插件、移动端及数字员工等多款产品,全球服务用户超500万。此前,QoderWork已上线设计、写作等工作台及行业专家套件,并推出具备记忆与反思能力的“意识”系统。

来源:IT之家

OpenAI ChatGPT 语音最大规模升级:双向 AI 语音模型 Bidi 1 已上线测试12:341评

OpenAI已开始测试新一代双向AI语音模型Bidi 1,部分用户在网页版和App版ChatGPT中已发现该功能。Bidi 1位于设置中的模型选择器内,与标准语音和高级语音并列,选中后语音气泡变为黄色。其核心突破在于支持并行交互:ChatGPT可在说话时继续监听用户,并能中途响应新指令。测试显示,用户要求模型从1数到10时,中途打断并指令倒数,模型会立即执行。该技术使对话更接近真实口语交流,无需等待一轮对话结束。OpenAI官方尚未正式宣布,但预计本周将扩大测试范围。

来源:IT之家

AI可以用任何手段、写任何东西,但你得是个“中年老登”

PingCAP联合创始人黄东旭在完成db9项目后指出,AI已能使用任何方案和工具编写任何软件,未发现能力边界。db9是一个面向AI Agent的数据库,三个月内由AI生成超100万行Rust代码,零人类编写与审查,上线后服务超1万个实例,月token成本约2000美元。黄东旭认为,语言、框架、数据库选型等传统长期锁定正被打破,例如Bun从Zig迁移到Rust仅用6天,企业可借助Agent快速重写应用。他陷入虚无主义,认为软件生产本身已无意义,任何软件均可复制。行业趋势显示,AI正推动软件重写浪潮,从边界清晰的系统到无源码的遗留应用,如Cloudflare工程师周末重写Next.js,成本约1100美元。

来源:36氪

7亿收入、万亿市值,智谱值吗?

智谱AI于2025年1月登陆港股,五个月内股价涨约20倍,6月22日市值一度突破万亿港元,成为港股科技股第三大市值公司,仅次于腾讯和阿里。次日股价回调,收盘市值9674亿港元。该公司2025年收入7.24亿元,对应万亿市值市销率超千倍。市场追捧主要基于模型能力突破、商业化数据增长及战略卡位,但面临多重压力:OpenAI被传将发布GPT-5.6,上下文窗口达150万Token,超过智谱GLM-5.2的100万Token;7月8日将迎来首批股份解禁;同行MiniMax市值已从高点回落至约1600亿港元。多位投资人认为,智谱估值脱离基本面,但战略地位绝对,能否维持万亿市值取决于模型性能、国产算力底座、Agent平台及商业化增速等变量。

来源:36氪

6月22日·星期一

智谱到底值不值万亿市值

截至6月22日,智谱港股盘中市值约1.07万亿至1.1万亿港元,折合约1400亿美元。该公司2025年收入同比增长132%,其中本地部署收入5.339亿元,云端API收入1.904亿元,但净亏损47.2亿元,调整后净亏损31.8亿元。按当前市值计算,市销率约1600倍。6月17日,智谱发布并开源GLM-5.2,次日股价创出新高;同时其科创板IPO辅导进入验收阶段,拟募资约150亿元,其中120亿元用于大模型研发和算力建设。市场认为,其估值基于“国产AGI第一股”的期权叙事,而非基本面。与OpenAI相比,智谱市值约为其六分之一,但收入、用户和生态差距显著。分析指出,万亿市值需未来达到200亿至500亿元级别收入,目前其收入不足10亿元。

来源:36氪

智谱与MiniMax暴涨背后的三个“资本魔术”

智谱与MiniMax近期在港股和科创板表现异常,股价大幅上涨,但背后并非技术或业绩驱动。智谱2025年营收仅7.24亿元,MiniMax约5亿元,两家均持续巨亏,却支撑起数千亿市值,甚至超越小米、京东。本轮行情主要

来源:36氪