AI  NEWS

AI 资讯

每日 AI 快讯 · 实时追踪人工智能行业最新动态

8月19日·星期三

AI for Science进入新阶段:机器人正在成为科研新基础设施

具身智能机器人正成为科研领域新基础设施。今年7月,国家级科研平台实验室引入源络科技与实验室联合研发的人形机器人Monte2,可自主完成试剂取放、配置、分液及细胞毒性检测等长序列实验操作,无需人员值守。该实验室计划到2027年底将机器人规模扩展至约百台,通过AI统一调度集群。此前,Monte2已在华大制造投入使用。 全球自主实验室趋势加速:利物浦大学团队2024年在《Nature》展示连续运行8天、完成680次实验的自主系统;伯克利A-Lab在17天内合成41种新材料;北卡大学将数据采集速度提升10倍。卡内基梅隆大学、谷歌DeepMind等机构也在开发具备文献理解与实验设计能力的AI系统。 源络科技基于自研OPN物理原生模型,推动实验室3.0发展,使机器人具备以物体为中心的环境理解、连续数小时稳定执行及多模态实时感知能力,已实现40余种生物实验操作,精度达亚毫米级。专家认为,自主实验室将作为人类研究者的合作者,缩短科研时间与成本,但不会取代人类的专业判断与创造力。

来源:InfoQ

Java 近期新闻:Shenandoah GC、TeamCity CVE、A2A Java SDK、Camel、Gradle、GlassFish

Java近期多项更新。JDK 28的JEP 535将Shenandoah垃圾收集器默认设为分代模式,非分代模式将被弃用并移除。JDK 27首个候选版本发布日期由8月6日推迟至8月20日,以配合关键补丁更新发布。GlassFish 8.0.4发布,修复多个安全漏洞,包括允许未授权接管域的高危漏洞。A2A Java SDK 1.2.0发布,新增任务流生命周期监听接口。Apache Grails 8.0.0第五个里程碑版本发布,重构了类注入转换器并扩展插件处理能力。Apache Camel 4.22.0引入两项AI集成新功能。TeamCity披露CVE-2026-63077漏洞,可绕过认证执行任意命令,官方建议升级或安装补丁插件。Gradle 9.7.0发布,将隔离项目性能特性提升至孵化阶段,并优化配置缓存以缩短构建时间。

来源:InfoQ

明道云举办首届 Real AI Contest,面向真实落地的企业 AI 应用

明道云近日举办首届Real AI Contest,聚焦已实现真实落地的企业AI应用案例。赛事面向已完成从概念到部署全流程的团队,采用统一标准进行评审,现金总奖池为8万元人民币,报名不收取费用。比赛旨在推动企业级AI应用的实践交流与成果展示。

来源:InfoQ

网易传媒 AI 另辟赛道:近千亿研发,蜜蜂AI杀入年轻人社区

网易传媒近日披露其AI战略布局,宣称近五年累计研发投入接近千亿元,其中相当部分用于AI技术储备。该公司推出面向年轻用户的AI原生社区产品“网易小蜜蜂”,并以此作为消费者端AI入口“蜜蜂AI”的核心验证平台。网易传媒表示,其AI路径与市场上以聊天框为起点的产品不同,强调将AI嵌入社区互动、内容创作及用户日常场景,减少用户编写提示词的需求。该产品已积累校园百科、就业信息等内容,并有数千所学校社团入驻。网易传媒同时提出“简单、创造力、知识共建”三个产品方向,尝试通过社区数据辅助AI自动补全上下文,并探索用户参与知识验证与共建的机制。针对内容真实性及隐私问题,平台已引入用户志愿管理员并设置隐私加密选项。网易目前未设定蜜蜂AI明确的商业化时间表,团队称现阶段重点在于验证产品价值。

来源:InfoQ

Canva 分享了基于 S3 的架构,用于管理数亿个会话的会话撤销

Canva近日公开了其会话撤销基础设施的重新设计方案,旨在支撑数亿个活跃会话,同时避免多数身份验证请求触发联网数据库查询。新架构将撤销数据以紧凑不可变形式存入Amazon S3,并作为内存索引分发至应用网关,据称部署速度提升、数据库开销减少,撤销缓存内存占用降低87.5%。 此前,Canva将12小时撤销数据存于内存,会话刷新仍需持续查询MySQL,规模扩大后数百个网关实例并发请求超百万条撤销记录,造成数据库负载压力。新方案将12小时窗口划分为30分钟的S3对象,每次撤销以16字节二进制记录表示,排序数组支持直接内存搜索。网关通过条件GET下载变更块,丢弃超时数据;异步工作进程合并新撤销记录并上传,条件PUT提供乐观并发控制,ZooKeeper仅用于减少冲突。 该设计亦兼顾恢复与部署,网关可下载相关数据块重建本地状态,无需依赖数据库。工作节点每秒可处理超2000次撤销,含百万撤销的数据块二进制大小约16兆字节。迁移后,Canva将撤销数据库缩减至两个只读副本,数据库负载随撤销写入吞吐量及网站流量扩展,而非网关实例数。方案在Reddit引发讨论,有建议采用短效访问令牌加刷新令牌方案,Canva工程师回应称内存撤销数据可避免频繁刷新带来的数据库负载与可用性瓶颈。

来源:InfoQ

图灵奖得主萨顿警告:AI 行业过度依赖合成数据是一个大错误

图灵奖得主、强化学习之父里奇·萨顿在红杉资本播客中警告,AI行业过度依赖合成训练数据是重大方向性错误。他认为真实世界远超任何模拟环境,AI应通过与现实环境互动来学习。萨顿新创立的Oak Lab公司正实践该理念,致力于开发能从自身经历中学习的AI智能体。

来源:IT之家

网络攻击频发,法国政府部门将用 AI 检测网络安全漏洞

法国公共财政总局近期连续遭网络攻击致数据泄露后,法国政府宣布将引入人工智能工具检测政府部门网络安全漏洞。行动和公共账目部官员达维德·阿米耶尔表示,将雇用本国AI供应商执行该任务,如米斯特拉尔人工智能公司。此前该机构于6月和7月两次遭攻击,分别导致约70万纳税人信息及约20万个土地登记账户数据泄露,17日又发现另一起事件,损失仍在评估。今年2月,法国银行账户国家数据库也曾遭非法访问,涉及约120万个账户。法国总理勒科尔尼已要求加快加强政府信息系统安全。米斯特拉尔成立于2023年,总部位于巴黎,被视为欧洲AI代表性企业,微软曾与其合作建设算力基础设施。此次选用本土供应商,反映欧洲推动“AI主权”、减少对美国科技依赖的长期趋势。

来源:IT之家

Anthropic 称 Claude Desktop 后台启动速度比 1 个月前快了约 2 倍

Anthropic于8月19日通过X平台宣布,其Claude Desktop应用的后台启动速度较一个月前提升约两倍,该数据覆盖95%的使用场景。官方解释称,此前应用在后台启动时会限制计时器并使JS引擎进入省电模式,现优化为即便窗口隐藏也能全速启动。同时,Claude Code CLI在99%的使用场景下CPU占用率降至原先的一半左右。该改进主要

来源:IT之家

日本公布 AI 草案,敦促开发者披露训练数据

日本内阁府于8月18日公布生成式AI开发者指导方针草案,要求开发者披露训练数据及数据收集方式。该草案旨在平衡AI技术创新与版权保护,一方面规范开发者合理使用知识产权,另一方面保护创作者权益。草案虽不具备法律约束力,但敦促开发者保持透明度,公开数据收集方法,并明确建议避免从盗版网站获取数据。框架鼓励开发者披露训练数据集中是否包含受版权保护的材料,如漫画、音乐和电影,同时要求建立内部通知系统,在训练数据与生成内容存在相似版权作品时告知用户。

来源:IT之家

“微信重大更新”引围观,总结 / 点评 / 修图长本事了!更有发图 / 表情彻底加强

微信iOS版通过灰度测试悄然上线三项AI功能,覆盖公众号、朋友圈及图片处理场景。公众号文章新增AI总结,可快速提炼核心内容;朋友圈支持AI点评,自动生成评论建议;图片编辑引入AI修图,优化拍摄效果。同时,微信Windows和Mac端4.1.13正式版新增“合并发图”功能,支持多张图片一次发送,并加入表情动态预览,提升聊天交互体验。此次更新未升级版本号,属渐进式推送,部分用户已可体验。新功能聚焦内容消费与社交分享效率,AI能力首次深度嵌入常见操作路径,但具体覆盖范围及用户反馈尚待观察。

来源:IT之家

7月24日·星期五

菲尔兹奖得主邓煜谈 AI:已能帮助数学证明,但不能替代独立思考

2026年菲尔兹奖得主、芝加哥大学教授邓煜近日表示,已在数学研究中应用AI辅助工具。他使用GPT解决了一个连续数日未突破的数学特例,并指出AI使研究环节更便捷。邓煜通常让AI为基本确定的结论提供证明,再行核验;AI也能补充其未知的已有结构或标准结论。在近期工作中,GPT为一个主要命题的特殊情形给出了简单证明,虽因无法推广而未写入论文,但提供了有价值思路。他认为,即使AI无法完成最终证明,也能帮助研究者快速探索局部路径。他期待未来形成人类负责框架与核心思路、AI完成技术推导的协作模式。但邓煜强调,学生使用AI时需保持判断力,不能因AI给出看似完整的论证就跳过独立判断与严格核验。

来源:IT之家

OpenAI全面开放ChatGPT Health功能,通用AI助手切入医疗健康赛道,垂类App是否还有突围机会?

OpenAI 正式向美国用户全面开放 ChatGPT Health 功能,支持对接 Apple Health 等个人健康数据平台。该功能面向18岁以上用户,提供常见病症、用药指导、检查结果解读及心理健康等AI健康建议,已在网页端和iOS端上线,所有版本用户均可使用。七麦数据显示,7月24日ChatGPT占据美国iPhone免费榜、畅销总榜及效率畅销榜首位。此举标志着通用AI助手正向医疗健康等高信任场景渗透,竞争焦点从响应速度转向用户信任与数据授权透明度。行业分析认为,垂直赛道开发者仍有机会,通过聚焦单一场景、构建完整业务闭环及强化数据隐私说明,可在头部产品挤压下突围。

来源:36氪

从“卷模型”到“算总账”:AI 产业竞争开始拼什么 | 请回答 WAIC 2026

在 WAIC 2026 上,AI 产业竞争焦点从模型能力转向“算总账”。昆仑万维方汉指出,Agent 技术通过 Harness 调度大幅扩展模型能力边界,使文本模型向 Coding 收敛,国产模型正缩小与顶尖差距,但文本 Scaling 或已达上限。北电数智郭文观察到 B 端应用更复杂,国产算力以超节点形式出现,多芯融合方案提升效率。L2F 光源资本吉星提出“三本账”:中美基建投入超 7000 亿美元,收入仅约 500 亿;推理 token 价格降至八分之一,但总成本反升;资本关注点转向财报实绩。DeepKernel 刘卓涛强调,Claude Fable5 引发网络安全恐慌,且算力成本翻倍,AI Infra 降本增效成关键。对于资源分配,中型公司必须押注模型能力,中小公司应优先产品定义,结合 Agent、工程化与成本优化。

来源:InfoQ

开发者的 AI 助手升级了:Android Studio 支持多个 Agent 同时处理任务

Android Studio Quail 2 稳定版发布,核心升级在于其 AI Agent Mode 支持多个对话并行处理任务,开发者可同时进行 UI 重构、修复规则或生成文档,无需等待单一任务完成。该模式除 Gemini 外还兼容多个大语言模型,Google 为此推出 Android Bench 基准测试,针对常见开发任务评估模型表现。调试方面,新版本将开源工具 LeakCanary 集成至 IDE,将堆分析从手机转移至电脑,使泄漏追踪速度提升五倍。App Quality Insights 功能现已完全集成,可自动分析堆栈与设备数据定位崩溃原因并给出修复建议。此外,实验性功能探索平台 Studio Labs 正式稳定,开发者无需升级 IDE 即可试用新特性。该版本还包含了 IntelliJ 平台的稳定性与性能改进。

来源:InfoQ

具身智能争夺下一块拼图:一目科技估值破百亿,触觉传感器走向量产

一目科技完成超10亿元E轮融资,投后估值超百亿元,由多家人民币基金、美元基金及产业投资方参与。该公司成立于2016年,创始人李智强具备环境工程、AI及硬件研发背景。本轮资金将用于触觉感知材料、芯片、算法及模型研发,并扩大产线以支持订单交付。一目科技主要研发仿生视触觉传感器,通过微型光学系统记录接触面形变,计算压力、剪切力等力学信息。其传感器厚度已降至3毫米内,分辨率超万点,力分辨率0.005N,按压寿命超100万次。公司已建立自有产研体系,向机器人、数据采集、汽车、制药等领域交付产品。目前,触觉传感器主要服务于具身智能数据采集企业和机器人厂商,用于模型训练及灵巧手集成。一目科技正围绕触觉数据采集、信号编码及多模态模型训练构建方案,并与Stanford University等推进TouchNet开源数据集项目,计划2026年底前开放更多真实数据。

来源:InfoQ

Pinecone 推出 Nexus 引擎:为 AI 智能体整合业务上下文并生成结构化数据

Pinecone 正式上线 Nexus 知识引擎,旨在将企业分散的业务数据转化为AI智能体可直接检索的结构化层。该引擎允许团队一次性摄入并整理合同、知识库、会议纪要等资料,实现数据跨智能体复用,降低每次查询产生的词元成本。早期采用者数据显示,在金融和法律领域,Nexus能完成全部指定任务,而编码智能体完成率仅6%,RAG系统为66%;词元消耗降至原先的1/9至1/15。在企业数据管理方面,Nexus准确率达90%,RAG系统为65%,每份文档整理成本为0.0038美元。Nexus以工作空间为核心,通过上下文划分数据集,并支持清单定义数据摄取与转换规则。数据摄取支持本地文件、Box、Microsoft OneLake等

来源:InfoQ

北大「双菲」:天才们的鲜活人生

北大校友王虹与邓煜在2025年国际数学家大会上共同获得菲尔兹奖,成为首次获此殊荣的中国籍数学家。王虹(35岁)是菲尔兹奖历史上第三位女性得主,她与合作者用127页论文证明了三维空间的挂谷集猜想,解决了这一百年难题。邓煜则与合作者证明了硬球系统的牛顿动力学严格收敛到玻尔兹曼方程,部分解答了希尔伯特第六问题。两人均毕业于北京大学,邓煜曾获国际数学奥林匹克金牌,后赴麻省理工深造。该奖项标志着中国数学领域的重大突破。

来源:36氪

九问梁文锋:关于克制、底线和人

DeepSeek创始人梁文锋在一场投资者交流会上阐述公司战略。他表示,DeepSeek的目标是实现通用人工智能(AGI),无意与字节、腾讯等公司竞争,也不追求成为下一个超级App。公司坚持开源和克制策略,认为AI市场足够大,独占将被历史抛弃。API定价基于合理利润,以十个月收回硬件成本为标准,而非利润最大化。商业变现并非首要目标,团队更注重让技术惠及更多人。公司核心利益是保持团队稳定性,认为只要核心团队不散,AGI终将实现。近期融资有助于缓解人才流失风险,员工期权价值较大。梁文锋强调,资金和资源不成问题,团队稳定是唯一不可退让的底线。

来源:36氪

Kimi目标估值飙升至超3300亿元

月之暗面计划于8月启动上市前最后一轮融资谈判,目标投前估值500亿美元(约3385亿元人民币),预计短期内先完成一轮315亿美元估值的融资,随后洽谈Pre-IPO轮。公司已向投资人发送上市议案,最快6个月内完成港股上市。若达成目标,其估值在两个月内涨1.5倍,三年多飙升上百倍,将刷新国内独立大模型创业企业估值纪录。国资阵营正成为融资核心参与者,现有股东中杨植麟持股51.83%为第一大股东,IDG资本管理基金持股11.76%。Kimi K3模型总参数达2.8万亿,配备100万Token上下文窗口,为全球参数最大开源模型,在全球编程榜单登顶,综合智能指数位列第三。月之暗面否认模型蒸馏传言,称性能提升

来源:36氪

「黄仁勋」最新专访:AI末日论是“胡说八道”

英伟达CEO黄仁勋在最新专访中表示,AI末日论和就业毁灭论是“胡说八道”。他指出,全球一半AI研究人员是中国人,开放比封锁更重要,美国公司应被允许使用中国AI模型。目前英伟达对华销售额几乎为零。他认为中国模型如Kimi、DeepSeek的崛起是好事,开放模型能扩大需求,带动英伟达硬件销售。AI不会摧毁就业,反而创造了更多岗位,如放射科医生、律师助理数量增长。他呼吁政府规范AI应用而非限制技术发展,并强调美国科技产业已准备好应对全球竞争。黄仁勋预计未来十年半导体产业需扩大5至10倍,以满足AI代理等需求。

来源:36氪

梁文锋押注的方向,中国00后团队先交卷了,性能直逼Opus 4.8

中国00后团队创立的Mind Lab发布Macaron-V1模型,性能接近Opus 4.8。该模型基于Mixture-of-LoRA架构,含748B参数的旗舰版Venti和35B的标准版Tall,通过四个独立LoRA模块分别处理聊天、编程、Agent和生成式UI任务,运行时由路由器动态切换。在SWE-bench Verified测试中,Venti版以85.6分登顶,超越DeepSeek-V4-Pro等模型。Macaron-V1支持开放权重和私有化部署,采用Model与Harness共设计确保训练与部署环境一致。Mind Lab成立于2025年10月,团队30余人,年初完成5000万美元A轮融资,由美团领投。全球仅两家团队能在万亿参数规模上跑通LoRA强化学习,另一家为Mira Murati的Thinking Machines Lab。

来源:36氪

Kimi K3,已经撕裂了整个硅谷

7月16日,中国AI公司月之暗面发布Kimi K3模型,引发硅谷和华盛顿分裂。K3拥有2.8万亿参数、MoE架构,支持100万token上下文,在智能指数上排名第三,前端代码能力登顶Arena榜首。其API价格为每百万输出token 15美元,低于美国闭源模型,且权重将完全公开。白宫科技政策办公室主任指控K3涉嫌大规模蒸馏美国模型;OpenAI总裁承认其能力但强调基础设施优势;近200家硅谷创业公司联名警告封禁中国开源模型将导致美国企业死亡;英伟达CEO黄仁勋则表态美国公司应被允许使用中国模型。K3此前已嵌入Cursor、DoorDash等硅谷产品生产流程。

来源:36氪

新晋菲尔兹奖得主,当天宣布加入OpenAI

新晋菲尔兹奖得主Jacob Tsimerman在获奖当天宣布加入OpenAI,从事AI安全研究。他于1988年生于俄罗斯,曾获IMO满分,16岁入读多伦多大学,两年完成本科,2011年获普林斯顿博士学位,后成为多伦多大学史上最年轻正教授。此次获奖表彰其在André-Oort猜想上的突破,该猜想悬置近40年。他此前曾发表论文分类AI导致人类灭绝的场景,并认为AI可能在两年内超越数学家。其学生三天前用AI推翻雅可比猜想,现任职于Anthropic。本届菲尔兹奖同时破解Kakeya猜想、希尔伯特第六问题等世纪难题。

来源:36氪

GPT-5.6证伪30年图论猜想,北大校友5天连破6题

GPT-5.6 Pro证伪了图论领域存在30年的Dinitz-Garg-Goemans猜想。模型通过构造一个三终端图反例,证明分数流成本为58,而任何容量违规不超过15的不可分割流成本至少为60,直接推翻该猜想。同一天,哥伦比亚大学博士Shouqiao Wang使用GPT-5.6 Sol配合Codex工作流,在5天内解决了6道此前标记为开放的Erdős问题,尝试约13道,成功率为46%。其中一道题目曾由数学家陶哲轩研究过。Wang定义了严格的解题标准,并采用多Agent对抗审计流程,确保结论的可靠性。Dmitry Rybin是推翻图论猜想的AI创业公司联合创始人,拥有香港中文大学机器学习博士学位及数学竞赛金牌。业界热议,这可能是人类最后一届菲尔兹奖。

来源:36氪

6月29日·星期一

马斯克:Grok 4.5 已在 SpaceX 和特斯拉内部测试,性能接近 Opus 模型昨日 19:0553评

马斯克近日在X平台透露,Grok 4.5已在SpaceX和特斯拉内部开启测试。该模型基于自研的1.5万亿参数V9基础大模型打造,并引入Cursor数据完成补充训练。早期评测显示,其性能接近甚至有望超越Opus模型。基于人类反馈的强化学习仍在持续提升模型能力,配套调度框架也每日迭代优化。此外,马斯克表示,SpaceX今年将每月推出一批从零开始训练的全新模型。

来源:IT之家

消息称百度旗下昆仑芯瞄准 500 亿美元估值,计划赴港 IPO06:474评

百度旗下AI芯片子公司昆仑芯计划在香港上市,目标估值约500亿美元(约合3405.58亿元人民币)。据知情人士透露,部分投资者被要求认购相当于申购金额3至7倍的芯片产品,方可参与IPO。目前该消息尚未获官方证实,百度未予置评。此前有传闻称字节跳动考虑采用昆仑芯AI芯片,腾讯已成为其客户。昆仑芯于今年1月1日通过联席保荐人向港交所提交上市申请,分拆后仍为百度子公司。该公司前身为百度内部AI芯片研发部门,2012年成立,后独立运营,百度仍为控股股东。

来源:IT之家

“AI中间商”Liblib,靠什么撑起20亿美元估值?

AI视频生成领域新晋独角兽出现。Liblib母公司演语科技完成近3亿美元B+轮融资,由Granite Asia、腾讯、顺为资本联合领投,投后估值超20亿美元。该公司无自研模型,通过聚合主流模型为设计师、创作者提供工具。创始人陈冕曾任职字节跳动,负责剪映与CapCut全球商业化。核心产品包括AI创作社区Liblib AI、设计Agent星流及视频创作平台LibTV。Liblib AI累计用户超3000万,全公司年化收入突破3亿美元。LibTV上线后月收入增长超13倍,主要受益于短剧市场对AI视频工具的需求。其竞争优势在于价格低于原模型平台,通过采购算力赚取差价。但平台存在内容合规隐患,且投资人认为聚合平台护城河较浅,面临大厂API开放或模型迭代带来的替代风险。

来源:36氪

6月28日·星期日

世界模型、元宇宙、数字孪生、物理AI:它们是一回事吗?

世界模型、元宇宙、数字孪生、物理AI等概念并非同一事物,但均指向数字与物理世界融合的趋势。世界模型属于底层认知层,负责让AI理解并推演世界。元宇宙是空间体验层,依赖世界模型自动生成3D内容以降低生产成本。Web3.0聚焦数字资产所有权,与技术内核不同。仿真数据平台是1.0版本,靠人工搭建场景;世界模型是2.0,通过AI自动生成无限接近真实的场景。数字孪生是复刻现实的“镜子”,世界模型则具备预测未来的能力。物理AI包含感知、理解、决策三部分,世界模型负责理解规律并预测结果,是物理AI的核心组件。这些概念共同构成从底层算力到上层体验的层次结构,世界模型处于认知层,是多个概念的共同底座。

来源:36氪

AI预测世界杯小组赛:混元第一,千问DeepSeek打平

2026美加墨世界杯小组赛结束,联想与咪咕联合发起的世界杯预测人机大战中,12家国产大模型与人类玩家同台竞猜。AI整体命中率约61.9%,人类玩家为54.6%。腾讯混元和中移九天并列第一,命中率68.1%;百度文心、千问、DeepSeek以63.9%并列;阶跃星辰垫底,命中率43.1%。AI擅长预测强弱分明的比赛,但在平局预测上表现不佳,20场平局仅命中11次。厂商参与目的各异:联想咪咕侧重能力横评,千问结合用户互动与公益,Kimi展示Agent处理复杂任务的能力。AI预测本质是信息整合与概率表达,技术路径包括纯提示工程、RAG检索增强、多智能体协作及统计模型结合大模型翻译,多数厂商采用前两种轻量级方案。

来源:36氪

梁文锋署名的DSpark,看懂这10个点就够了!

DeepSeek发布新论文DSpark,由梁文锋署名。该方案通过系统工程与模型协同设计,实现单用户速度提升85%,高并发场景有效吞吐量翻4倍。Fireworks AI联合创始人Dmytro Dzhulgakov将其核心梳理为10个概念。DSpark融合并行与串行策略:先利用DFlash并行骨干网络一次性生成所有候选位置的基础logits,再通过轻量级顺序头(马尔可夫头)逐个注入前缀依赖偏置,修正后缀衰减问题。该方法在离线测试中,平均接受长度比Eagle3高26%-31%,比DFlash高16%-18%。草稿长度从4扩展到16时,每轮额外延迟仅增加0.2%-1.3%,接受长度最高提升30%。DSpark还通过复用目标模型内部状态、可变长度草稿与硬件感知优化,在降低草稿耗时、提高猜测准确率和减少验证浪费三个杠杆上实现系统性突破。

来源:量子位

前端工程师最不想看到的开源项目出现了,一行命令克隆任意网站

GitHub上一个2万星标的开源项目ai-website-cloner-template,可通过一行命令像素级克隆任意网站。用户输入URL后,AI自动完成全站逆向解析:采集页面元素并计算样式、遍历滚动与点击等交互逻辑、提取设计Token,再调度多Agent基于Git工作树并行重建组件,最终输出可直接运行的完整Next.js工程。产物内置标准化路由、模块化组件与TypeScript类型定义,支持Claude Code、Cursor、Copilot等主流AI编程助手。用法简单:克隆模板仓库后安装依赖,启动Claude Code并输入/clone-website命令即可。项目还支持批量处理多个URL。作者建议用于将WordPress等旧站迁移至Next.js、找回丢失代码仓库的网站,或研究特定布局实现。但强调禁止钓鱼、需尊重版权并核查网站服务条款。

来源:量子位

苹果推出 Core AI 框架,为自研芯片优化端侧生成式 AI

苹果在2026年WWDC上发布Core AI框架,作为Core ML的官方继任者。该框架专为Apple Silicon优化,支持在iPhone、iPad、Mac及Apple Vision Pro上完全本地运行大语言模型和生成式AI,可部署从30亿到700亿参数的模型。Core AI提供统一硬件访问API,支持CPU、GPU和神经网络引擎无缝协作,并采用内存安全的Swift API实现零拷贝数据路径。其提前编译技术可实现近乎瞬时的模型加载。开发者可通过Core AI PyTorch转换PyTorch模型,或利用内置复合算子构建新模型。模型会自动针对当前硬件和操作系统版本进行特化。苹果建议将Core ML用于经典非神经网络ML,Core AI用于神经网络和Transformer,MLX用于自定义模型权重处理。社区认为Core AI简化了高性能LLM集成,但长期价值取决于官方与社区的后续发展。

来源:InfoQ

94年小伙融资30亿,教AI玩游戏

General Intuition完成3.2亿美元(约21.77亿元人民币)A轮融资,由科斯拉风投领投,General Catalyst、谷歌前董事长施密特、亚马逊创始人贝索斯跟投。该公司公开融资总额达4.54亿美元,估值23亿美元。其核心资产是游戏剪辑平台Medal,该平台记录玩家在《堡垒之夜》等游戏中的操作与动作标签,形成海量“画面-动作”对应数据。创始人Pim de Witte(1994年出生)利用这些数据训练AI智能体,使其学习空间-时间推理与行动规律。OpenAI曾尝试以5亿美元收购Medal。目前团队约25人,Medal约65人。公司计划先服务游戏行业,提升NPC与陪练的真实性,并逐步拓展至机器人、无人机、自动驾驶仿真等领域,目标成为行动模型底层供应商。

来源:36氪

DeepSeek开始造富

DeepSeek近期启动大规模招聘,并完成510亿元A轮融资,投后估值达4000亿元。此举标志着该公司从神秘实验室转型为商业化AI公司,首次为员工期权定价,解决流通与变现问题。中国AI行业进入造富阶段,智谱等多家公司处于Pre-IPO,估值持续上涨。AI竞争正从模型阶段转向Agent阶段,DeepSeek成立Harness团队,对标OpenAI Codex和Anthropic Claude Code,参与全球Agent竞争。招聘旨在重新定义工程师标准,寻找能推动Agent产品落地的人才。行业人士认为,加入AI产业核心层可提前获得未来十年稀缺技能,类似过去互联网、社交、算法推荐时代的红利。

来源:36氪

Anthropic 调研:约半数 Claude 用户称 AI 已可承担一半以上的工作07:553评

Anthropic一项针对约9700名Claude用户的调研显示,约半数受访者认为AI已能承担其一半以上的工作。其中,33%的用户表示AI可完成自身30%至60%的任务,14%认为比例在60%至90%,另有4%称Claude能独立完成全部工作。展望未来12个月,约26%的用户预计AI将接手大部分工作。在具体场景中,Claude处理最多的任务包括营销文案撰写(80%)、博客创作(81%)及数据库查询(82%)。研究指出,无论从业年限、地域或行业,用户对AI迭代速度的预期高度一致。职场新人AI任务占比最高,焦虑感也最强;而重度使用者则更为乐观,认为个人价值在提升。绝大多数受访者希望与AI协同工作,而非被取代,期待AI承接基础性工作,并呼吁技术红利广泛共享。

来源:IT之家

6月27日·星期六

第一批一人公司,现在怎么样了?

摘要:AI领域“一人公司”(OPC)概念兴起,创业者通过AI Agent组建虚拟团队。独立开发者超级峰开发了MotiClaw产品,用于管理多个AI员工,他本人负责指挥Agent完成开发、内容与运营工作。前微软产品经理Kelly在离开大厂后,尝试构建“人-管理Agent-执行Agent”的两层结构,以解决多Agent协作效率问题。创业者Weijia与Daniel开发了BeeVibe多Agent协作平台,用户可组建工程、市场等Agent团队,Agent间可自主沟通与协作,仅在无法解决时由人类介入。资深投资人阮飞创办锋领资本,未组建传统团队,而是搭建AI中后台,包含行业研究、投资报告生成、合同审查等Agent,并设置“AI对抗合伙人”角色,用于质疑投资决策。这些实践表明,一人公司正从“个体户”转向以Agent团队为主体的新型组织形态。

来源:量子位

梁文锋署名论文,DeepSeek首轮融资后大动作:生成速度大涨85%

DeepSeek在完成500亿元首轮融资后,于6月27日开源了推理加速方案DSpark及配套训练框架DeepSpec。该方案推出DeepSeek-V4-Pro-DSpark和DeepSeek-V4-Flash-DSpark两款模型,通过增加推测解码模块提升推理速度并降低成本。据梁文锋署名、与北京大学合作的论文,DSpark采用半自回归架构与置信度调度校验机制,在真实用户流量测试中,相比成熟基线方案,单用户生成速度提升60%至85%,同时避免了高并发场景下的吞吐率大幅下降。DeepSpec则提供了完整的训练与评估工具链,支持DSpark、DFlash和Eagle3等算法,开发者可将其用于优化Qwen3、Gemma等模型的推理性能。此次发布标志着DeepSeek在融资后率先聚焦推理优化,旨在加速模型产品化并提升算力效率竞争力。

来源:36氪

Ky 2.0 发布:重构 Hooks、改进超时机制,并内置 Schema 校验能力

由 Sindre Sorhus 开发的轻量级 JavaScript HTTP 客户端 Ky 发布 2.0 大版本更新。核心变化包括:重构 Hooks API,所有 Hook 统一接收包含请求、选项、重试次数等属性的状态对象,并新增在所有 Hook 前执行的 initHook;超时机制新增 totalTimeout 选项,用于限制整个请求生命周期总耗时;重试机制引入 NetworkError 类型,仅对 DNS 解析失败等网络故障自动重试。URL 处理方面,prefixUrl 更名为 prefix,并新增 baseUrl 配置,职责明确区分。响应数据处理上,.json() 方法支持 Zod、Valibot 等标准 Schema 校验,HTTPError 新增已解析的 data 属性。不兼容变更包括:要求 Node.js 22 及以上版本,所有 Hook 回调需迁移至新状态对象,空响应或 204 响应时 .json() 会抛出异常。Ky 定位为轻量级、贴近 Fetch 原生设计的 Axios 替代方案,体积仅几 KB,支持浏览器、Node.js、Bun 和 Deno。

来源:InfoQ

消息称 Anthropic 与美国政府达成共识,向 100 多家机构提供 Mythos 模型访问权限07:272评

Anthropic与美国政府达成部分共识,后者已解除部分出口管制,允许该公司向100多家美国机构(包括政府及大型企业)提供Mythos 5模型访问权限。两周前,美国政府以未公开原因对Anthropic实施出口管制,导致其下架Fable 5和Mythos 5模型。传闻称,亚马逊CEO安迪·贾西曾向美国财政部长通报一起模型“越狱”事件,导致政府认为存在滥用风险。目前,Anthropic尚未官宣Fable 5是否重新开放,但知情人士透露,该公司正与政府协商,朝恢复该模型的方向推进。

来源:IT之家

6月26日·星期五

两个Anthropic前员工,半年估值68亿

Anthropic前员工内沙布尔与梅塔创办的AI初创公司Mirendil,在种子轮融资2亿美元,估值达10亿美元(约68亿元人民币)。该公司旨在开发加速科学研发的AI,以推动药物、材料和机器人等领域的发现,目前团队约20人。投资方包括a16z、凯鹏华盈和英伟达。内沙布尔曾领导Anthropic的Discovery团队,梅塔则搭建过自动化AI研究平台。两人于2025年12月离职创业,认为当前大模型与智能体能力已足够支撑其目标。Mirendil计划构建开放平台,帮助科学家和机构建立自身AI研发能力,而非直接参与具体科学实验。此举被视为AI行业进入新阶段:从训练模型、打造产品,转向用AI改造AI研发本身。

来源:36氪

变天,AI大厂被疯狂抽血1.5万亿

微软等AI云计算巨头正经历资本市场的剧烈分化。2026年,微软、亚马逊、Meta、谷歌等企业的资本开支预计从2025年的约3800亿美元飙升至6500至7500亿美元。其中,微软2026财年AI与云基础设施开支接近1460亿美元,亚马逊预计高达1950至2000亿美元。然而,巨额投资并未立即带来股价回报。微软6月股价跌幅达21.6%,为2000年以来最大单月跌幅,市值从高点暴跌1.5万亿美元。资金大量流向芯片厂商,如英伟达、三星等,HBM内存和先进封装涨价导致大厂增量资本开支中40%至50%被芯片成本吞噬。微软管理层预计,2026年超1000亿美元的资本支出中,约250亿美元

来源:36氪

当 Agent 成为新的核心云用户:阿里云重新定义“用云范式”

阿里云发布云Skills门户,将300余款云产品及超2万个API升级为Agent-Ready能力,旨在让AI Agent更高效地调用云资源。调查显示,79%的企业已采用或计划采用AI Agent,近74%预计两年内应用Agentic AI。Agent正从客服、运营等业务系统嵌入云运维与架构设计,其自主规划、高批量、长任务特性对云平台提出新要求。阿里云通过Skills化、MCP化、CLI化三条路径标准化工具调用,并构建三层体系:Agent Gateway处理行为意图不确定性;Agent 3A(可认证、可授权、可审计)解决身份信任问题;Agentic Skills与Toolkit规范能力使用。此举旨在改变云产品被调用、发现、组合与治理的方式,为Agent操作云资源建立工程化约束,确保自动化有边界且可审计。

来源:InfoQ

英伟达黄仁勋:本轮 AI 基建周期长达数十年,将成人类历史上规模最大的基础设施项目昨日 19:0858评

英伟达CEO黄仁勋在6月24日年度股东大会上表示,本轮AI基础设施建设周期将长达数十年,或成为人类历史上规模最大的基础设施项目。他指出,人工智能正从根本上改变计算模式,从过去的检索、存储信息转向生成智能。词元作为智能基本单位,在新型数据中心“AI工厂”中被制造并转化为商业收益,计算能力越强,收益越丰厚。黄仁勋认为,这类基建与电网、交通系统等类似,需长期投入。当前,AI智能体正加速推动基础设施投资,因AI首次能胜任实质性工作并创造真实经济价值。

来源:IT之家

坚持万亿美元估值底线?曝 OpenAI 考虑将 IPO 推迟至明年07:293评

据《纽约时报》援引内部消息,OpenAI正考虑将首次公开募股推迟至明年。公司向顾问提出两种方案:一是2027年以1万亿美元估值上市,二是降低估值以加快进程。CEO奥尔特曼认为低于万亿美元的方案不可接受。此前,OpenAI曾秘密递交IPO申请,目标估值达万亿美元。但公司多次否认近期上市计划,2025年曾表示IPO非重点。2026年初有报道称,为抢在竞争对手前,OpenAI计划当年第四季度启动IPO,当时估值约5000亿美元。此外,美国国家网络总监办公室等部门因安全担忧,要求其分阶段发布新一代AI模型。OpenAI估值近年快速增长,2023年员工股票出售时已达800至900亿美元。

来源:IT之家

2.8万Star爆款作者竟被谷歌裁了,硅谷大佬火速抢人

谷歌员工Justin Poehnelt在任职近7年间,开发了开源命令行工具gws,该工具用Rust编写,可动态调用谷歌Discovery Service,支持Gmail、Drive等全家桶操作,并为AI Agent设计结构化输出。工具上线后登顶Hacker News,获2.8万GitHub星标,谷歌Cloud AI部门主管也公开推荐。然而,谷歌在Cloud Next 2026大会上宣布推出官方版Workspace CLI后,以品牌标识使用不合规为由解雇了Poehnelt。当事人认为真正原因是公司内部对AI Agent颠覆现有产品的恐惧。事件引发OpenClaw之父Peter Steinberger、OpenRouter、Vercel等公司CEO公开招揽。

来源:36氪

大厂终于不再逼用户“用AI”了

2026年6月,微信灰度内测原生AI助手“小微”,支付宝推出AI版并内置智能体“阿宝”。两款国民级应用不再推广独立AI App,而是将AI功能嵌入常用界面。用户可通过文字或语音让“小微”点外卖、查快递、总结朋友圈;“阿宝”则能调起缴费、寄快递、查公积金等服务。此举表明大厂意识到用户核心需求是让AI帮忙做事,而非单独下载App对话。测试反馈显示,AI在复杂任务如生成小程序雏形上表现较好,但在简单操作如点外卖时流程较慢。安全方面,两款AI在涉及资金操作时均需用户手动确认。市场分析认为,C端AI正从独立功能演变为嵌入基础设施的隐身服务。

来源:36氪

6月25日·星期四

豆包付费后,豆包手机仍免费,最大Token消耗者出现了

在MWC26上海展会上,AI终端成为焦点。IDC预测,2026年中国市场传统AI终端出货量将超3亿台,2027年渗透率超93%。联想推出AI主机P7,重约300克,功耗30W,算力达190 TOPS,支持122B参数本地模型,可在无网环境下以50Token/s速度推理,目标使80%的Token消耗产生于本地。多款AI眼镜集成实时翻译、导航等功能。荣耀提出未来终端将从应用容器转向智能体舞台。中兴展出与豆包合作的AI原生手机努比亚M153,可自然语言调用多App。智元联合创始人彭志辉认为,人形机器人将成为最大Token消耗者,其数据供给是行业瓶颈,智元已构建“三智一体”框架应对。

来源:36氪

AI杀猪盘来了,一年狂卷40亿美元,这把收割全美的“赛博镰刀”藏不住了

美国加州消费者近日起诉711、沃尔玛等加油站运营商,指控其使用英国公司Kalibrate开发的AI定价软件实施价格垄断。该软件收集加油站的成本、销量等核心数据后,向各站点下发统一价格建议,协调区域内加油站同步涨价。消费者测算显示,使用该软件的加油站每加仑汽油平均上涨6美分,极端情况达30美分,按此计算加州司机每年多支出近40亿美元。Kalibrate宣称已覆盖美国前十大燃油零售商中的8家。此前,租房软件RealPage因类似AI定价逻辑被美国司法部起诉,其算法利用房东共享的敏感数据统一指导租金,2023年导致美国租客额外支出超38亿美元,平均每月多付约70美元。

来源:36氪

Fable 5要回来了?「怪人」Dario Amodei被撤下谈判桌

距离Claude Fable 5因出口管制下线近两周后,其回归信号显现。6月24日,Claude Code v2.1.190二进制文件中新增“本周Fable 5额度已用完”等字符串,移除“需单独购买”字样。技术媒体确认该变更存在于生产包但未公开。此举暗示Fable 5将不再作为单独付费项目,而是整合进Pro、Max等订阅套餐内按周重置。同时,Amazon Bedrock仍保留Fable 5条目。此外,Anthropic与白宫沟通出现人事调整,CEO Dario Amodei被联合创始人Tom Brown取代。Brown自6月15日起率团队常驻华盛顿,与商务部长等官员谈判。6月19日,特朗普改口称Anthropic不再构成国家安全威胁。目前,Fable 5可能以深度嵌入订阅体系的方式重新上线,并调整访问与计费结构。

来源:36氪

月之暗面黄震昕:Kimi的目标是和海外三家模型掰手腕

月之暗面Kimi近期公布2026年业务数据:海外付费用户增长4倍,API收入增长400%,产品覆盖200多个国家和地区。公司B端负责人黄震昕在亚马逊云科技中国峰会上透露,企业业务占比持续提升,客户覆盖互联网、金融、制造、教育、医疗等行业,海外业务同步增长。月之暗面坚持模型底层创新,持续投入预训练、后训练及架构演进,认为模型能力远未触及天花板。在企业服务交付上,公司选择与亚马逊云科技合作,由Kimi提供模型能力,合作方负责行业解决方案、全球客户资源及合规体系。目前Kimi模型已上架Amazon Marketplace,未来将深度集成至Amazon Bedrock。公司员工规模仅300余人,资源配置优先于模型研发,目标是与海外三家头部模型公司竞争。

来源:36氪