动态列表

16岁创业，22岁做成百亿独角兽！3位高中同学帮大厂训AI年入1亿美金
《2025新智元ASI前沿趋势报告》全文
一图看透全球大模型！新智元十周年钜献，2025 ASI前沿趋势报告37页首发
苹果端侧AI两连发！模型体积减半、首字延迟降85倍，iPhone离线秒用
SceneSplat: 基于3DGS的场景理解和视觉语言预训练，让3D高斯「听懂人话」的一跃
慕尼黑车展 2025前瞻：中国队组团出海，BBA 走向「新」时代
国内外AI大厂重押，初创梭哈，谁能凭「记忆」成为下一个「DeepSeek」？
斯坦福：优化器「诸神之战」？AdamW 凭「稳定」胜出
字节跳动Seed推出「机器人大脑」Robix：让机器人学会思考、规划与灵活互动
浙大提出SSGaussian：注入语义与结构灵魂的3D风格迁移，让高斯溅射场景化身艺术品
苹果 iPhone 17 系列规格已全被曝光；Anthropic 全面封杀中国公司接入；今夜将迎来「血月」月全食｜极客早知道
OpenAI重组GPT-5「灵魂」团队！亚裔女负责人遭调离，罕见自曝AI幻觉祸首
设计师大解放！清华发布「建筑平面图」自动生成模型 | ACL'25
谁不用谁亏！Karpathy吹爆GPT-5：10分钟编码完胜Claude一小时，奥特曼秒回感谢
震撼实锤！清华姚班校友揭「1.4×加速」陷阱：AI优化器为何名不符实？
Anthropic被作家告了，违规下载700万本书，15亿美元和解了
英伟达的局：狂撒15亿美元，从Lambda那租到了搭载自家AI芯片的GPU服务器
OpenAI罕见发论文：我们找到了AI幻觉的罪魁祸首
00后以1.1亿美金「掀桌」，硅谷AI将书写影视新传奇终结制片旧时代
任意骨骼系统的模型都能驱动？AnimaX提出基于世界模型的3D动画生成新范式
IEEE TPAMI 2025｜ PointGST：参数量仅0.67%，精度首破99%，三维点云处理迎来谱域新范式！
ICCV 2025 | MOSEv2 全新亮相，第七届 LSVOS 挑战赛正式开启！
华为新问界 M7，6 小时订单破 13 万；等 eSIM，iPhone17 Air 首发无国行；特斯拉拟给马斯克 1 万亿薪酬
力压哈佛MIT！北交大、清华勇夺2025国际大学生程序设计竞赛金牌
长视频生成可以回头看了！牛津提出「记忆增稳」，速度提升12倍
0.01%参数定生死！苹果揭秘LLM「超级权重」，删掉就会胡说八道
今天，特朗普闭门宴请了大半个硅谷的CEO，马斯克老黄没来
追觅给洗地机，加了一双「灵巧手」
被网友逼着改名的谷歌Nano Banana，正在抢99%时尚博主的饭碗
不止会动嘴，还会「思考」！字节跳动发布OmniHuman-1.5，让虚拟人拥有逻辑灵魂
外滩大会主论坛阵容揭幕！顶级学者、产业领袖和青年创新力量共话未来
第一家 AI 浏览器公司，卖了 43 亿！
Nano Banana爆火之后，一个神秘的「胡萝卜」代码模型又上线了
博士申请 | 香港中文大学（深圳）游宇宁老师招收人工智能+生物医药全奖博士/实习生
推理加持的排序SOTA！把“召回+相似度”写进RL，文档排序更稳更准
KDD 2025 | 图异常基础模型来了：跨域零样本、少样本微调，原型残差全拿下
透明度罕见！百川公开M2完整技术报告，强化学习新范式引发行业关注
沉寂一个月，openPangu性能飙升8%！华为1B开源模型来了
多模态大模型持续学习系列研究，综述+Benchmark+方法+Codebase一网打尽！
TPAMI重磅综述：一文读懂人类动作视频生成的五大阶段与三大多模态技术
拓展天文学认知边界，Google DeepMind用AI助力LIGO，填补宇宙演化史缺失环节
拍我AI限时免费6天！手办、宠物、奇幻创意随你生成不限次！
传 DeepSeek AI 代理新模型年底发布；马斯克「金色擎天柱」首曝；比亚迪不回应销量下调传闻
通用LLM压缩算法，居然藏视频编码里！2.5bit实现4bit性能，硬件无缝支持
83岁用DeepSeek抢单，96岁凭AI挣养老钱！这群80+老人比你还会玩AI
「纳米香蕉」LMArena两周500万投票，引爆10倍流量！谷歌、OpenAI扎堆打擂台
DeepSeek大招曝光？梁文峰督战超级智能体：能自主学习，或年底发布
24999 元！华为推了一个「最大」的 Mate！
刚刚，李飞飞主讲的斯坦福经典CV课「2025 CS231n」免费可看了
又多了一个哄孩子AI神器，一张破涂鸦竟能秒变迪士尼动画
PosterGen：告别学术海报制作烦恼，从PDF一键生成「演示级」可编辑PPTX学术海报
「一句话生成爆款视频」，这款 AI 流量神器有点东西｜AI 上新
Claude Code凭什么牛？大模型团队天天用自家产品，发现bug直接就改了
刚刚，OpenAI发布白皮书：如何在AI时代保持领先
科研AI的进化论！系统梳理600+数据集与模型，上海AI Lab等发布科学大语言模型全景式综述
腾讯 ARC Lab 开源 IC-Custom ：一个强大且灵活的图像定制化工具！
长视频AI数字人来了！字节×浙大推出商用级音频驱动数字人模型InfinityHuman
全奖读AI！人工智能专业排名全球前10的MBZUAI启动本硕博项目招生
SIGCOMM 2025｜重新定义个性化视频体验，快手与清华联合提出灵犀系统
拜读了某大佬发表的N篇顶会，原来论文“灌水”是这么玩的
多模态大模型，真的“懂”世界吗？ICML 2025高分论文实锤核心认知盲区
听见空间！ASAudio全景综述：空间音频表示→理解→生成全链路
北京内推 | 阿里夸克教育团队招聘推荐大模型数据算法实习生
特斯拉下一代金色Optimus原型现身？一双「假手」成为最大槽点
让具身智能体拥有「空间感」！清华、北航联合提出类脑空间认知框架，导航、推理、做早餐样样精通
传特斯拉 Model Y L 日均订单过万；苹果联手谷歌，Siri 整合 Gemini；优必选获 2.5 亿，全球最大人形机器人订单
UCSD首个智能体浏览器发布！多页面设计，颠覆传统交互
Hinton最新警告：杀手机器人或将带来更多战争，最大担忧是AI接管人类
AI教父Hinton诺奖演讲首登顶刊！拒绝公式，让全场秒懂「玻尔兹曼机」
奥数金牌只是序章！OpenAI谷歌彻底打脸预言家，AI巨浪势不可挡
出货 1000 万台硬件后，我们和「凯叔讲故事」聊了聊「AI玩具」的核心
他不懂代码，却用 AI 黑掉 17 家医院和机构，Vibe Hacking 让全世界变成缅北
刚刚，谷歌放出Nano Banana六大正宗Prompt玩法，手残党速来
Anthropic承认模型降智后仍放任其偷懒？Claude Code用户信任崩塌中
ICCV 2025 | 基于时序增强关系敏感知识迁移的弱监督动态场景图生成
ICLR 2025｜KGExplainer：让新知识的发现“有理可循”
入局AI4S？CPO宣布「OpenAI for Science」计划：打造下一代科学工具
2025外滩大会下周开幕 16位院士、图灵奖得主领衔40多场思想盛宴
从复刻魔术开始，RoboMirage打开了机器人仿真的新世界
宇树科技官宣：年内提交IPO，或将冲刺科创板
其实，扩散语言模型在最终解码之前很久，就已确定最终答案
语音分离最全综述来了！清华等团队深度分析200+文章，系统解析「鸡尾酒会问题」研究
Benchmark新试炼场！从棋盘到德扑全覆盖，GAMEBoT虐测大模型推理力
【9月9日直播】大模型复杂推理技术：如何重塑AI推理逻辑
原子思维上线！Agentic Deep Research再进化：推理更深、答案更准
北京/苏州内推 | 微软亚太研发集团招聘AI智能预测实习生
USO：鱼与熊掌亦可兼得，字节跳动提出统一框架，完美融合主体与风格生成
刚刚，Anthropic在质疑声中获130亿美元融资，估值达1830亿
IROS 2025 | 机器人衣物折叠新范式，NUS邵林团队用MetaFold解耦轨迹与动作
iPhone 17定价曝光，仅Pro涨价；李斌：4季度实现月卖5万台车；COD「使命召唤」大电影官宣｜极客早知道
一张卡片，不仅 AI 了我的工作，还摸清了我的八字和 MBTI？｜AI 上新
马斯克曝终极AI计划！特斯拉堵上80%身家：500亿机器人打工，人类坐等拿钱
别错过这场AGI风暴！清华人大等AI大佬集结，剑指数字和物理世界进化
AI杀死首个世界名校？全球TOP 3「翻译界哈佛」倒闭，毕业校友成绝版
无惧AI失业潮的「铁饭碗」，微软揭秘了！能干到退休
为什么在小红书里的「电商」，长成了「市集」的模样
开学&教师节双重豪礼，英博云算力低至8毛8/卡时，赶紧薅起来
苹果新研究：不微调、不重训，如何让AI提问效率暴增6.5倍？
Scaling Laws起源于1993年？OpenAI总裁：深度学习的根本已揭秘
告别无效计算！新TTS框架拯救19%被埋没答案，推理准确率飙升
结构高度合理、具备理想特性，华东师大等提出分子生成新方法，协同生成原子与化学键
博士申请 | 北京大学计算机学院-中国电信招收计算机视觉方向联培博士生
ACM MM Asia火热征稿中！低年级PhD友好，不卷SOTA只看新意
经典机械物理模型 × 深度学习：揭开神经网络特征学习的秘密
ICML 2025 | 从联合空间到文本空间：测试时增强跨模态检索新范式
冲上热搜！美团大模型，靠「快」火了
DeepMind爆火论文：向量嵌入模型存在数学上限，Scaling laws放缓实锤？
ICCV 2025 | InterVLA：聚焦第一视角感知决策，大规模通用人-物-人交互数据集与评测基准
AI读网页，这次真不一样了，谷歌Gemini解锁「详解网页」新技能
性能逼近闭源最强，通义实验室开源Mobile-Agent-v3刷新10项GUI基准SOTA
广告，救不了 AI 搜索
14B打败671B！微软rStar2-Agent在数学推理上超过DeepSeek-R1
自搜索强化学习SSRL：Agentic RL的Sim2Real时刻
全球机器翻译比赛拿下30个语种第1名，腾讯混元翻译模型开源
腾讯回应米哈游起诉：QQ用户资料不能随便给；特斯拉首曝Cyber SUV；外卖「小电驴」须装北斗定位｜极客早知道
NeurIPS近3万投稿爆仓，强拒400篇论文！博士疯狂内卷，AI顶会噩梦来袭
同行评审濒临崩溃！一篇审稿报告450美元？科学家不再愿意「用爱发电」
CEO卷款夜逃迪拜，15亿美元独角兽爆雷！700印度码农冒充AI，坑惨微软
刚刚，DeepSeek最新发文！V3/R1训练细节全公开，信息量巨大
让图像会说话！视觉Token注入CLIP语义，TokLIP重塑多模态理解与生成
GRPO偷偷优化Pass@K？从0-1奖励到无偏策略，DeepMind揭示全面解法
EMNLP 2025｜人声解耦×伴奏对齐！浙大VersBand打造提示可控的歌曲生成框架
北京内推 | 联想研究院AI Lab招聘大模型算法实习生
快手的 2025：一个4亿人社区的新陈代谢，与2600万人的变现之路
开学了：入门AI，可以从这第一课开始
OpenAI大神：人工智能导论课程停在15年前，本科首选该是机器学习导论
中国电竞，已经是 Next Level！
NeurIPS 2025：高分论文也可能被拒，只为保住那25%左右的接收率？
DeepSeek、GPT-5都在尝试的快慢思考切换，有了更智能版本，还是多模态
把实验与计算「缝」到一张「地图」上：AI让材料发现路线更直观、可解释
字节跳动提出OneReward：一个奖励模型统一多任务图像生成，效果全面超越PS！
从「卖设备」到「建关系」，AI 硬件的破局点到底在哪里？
首个为具身智能而生的大规模强化学习框架RLinf！清华、北京中关村学院、无问芯穹等重磅开源
科普向：一文解构大模型后训练，GRPO和它的继任者们的前世今生
科研智能体「漫游指南」—助你构建领域专属科研智能体
今起 AI 生成内容必须亮明身份；大疆双摄 Pocket 4 曝光；微信公号留言广告上线

Claude不让我们用！国产平替能顶上吗？

2025-09-07机器之心来源

这几天，全球 AI 代码生成的竞争格局，迎来了新的拐点。

在编程领域，曾被视为王者的 Anthropic，似乎正在一步步失去昔日的锋芒，地位开始动摇。

这一方面源于 OpenAI GPT-5 系列模型的强势崛起，在与 Claude Code 的对战中大有「后来者居上」之势，AI 大神 Karpathy 现身说法并开始安利 GPT-5 Pro 的强大代码能力。

另一方面则是 Anthropic 自身的一系列迷之操作，先是放任并承认自家模型（包括 Claude Opus 4.1 和 Opus 4）降智，本周又宣布向包括中国在内的部分地区限制其 AI 产品和服务的使用。

在这个微妙的时间节点，多家国产大模型厂商向 Anthropic 发起了一波正面狙击。月之暗面发布了 Kimi-K2-0905 版本、阿里发布了超万亿参数的 Qwen3-Max-Preview。

前者作为 Kimi-K2 系列模型的最新版本，将上下文长度扩展到了 256k，针对前端开发等实际编程任务做了优化，长代码生成中的正确性、稳定性和逻辑一致性较以往版本有了提升。后者是阿里迄今最大的模型，同样提升了通用知识、数学推理、编程等多种任务的表现。

可以看到，国产大模型厂商近来集中在代码生成任务上发力。Kimi-K2-0905 强调了工具调用能力，并提升了模型与 Agent 框架（如 Roo Code）的集成性。

在使用该模型调用外部工具时，格式正确率现在可以达到 100%，不再需求人工修正。它还完全兼容 Anthropic API，方便接入与迁移。对 WebSearch Tool 的支持，可以通过实时信息检索提升任务效果。

随着 0905 版本的发布，近 30 天 Kimi-K2 系列模型在 Hugging Face 中的下载量超过了 39 万。

对于最新的 Kimi-K2-0905，有人直言「终于不用再为处理复杂的长任务而感到挫败了。」

此消彼长，随着国产大模型在代码生成领域持续发力，全球竞争的格局也许真的要变一变了。

能力、价格双优势，让国产大模型更能打

作为 Kimi K2 系列中最新的版本，Kimi-K2-0905 与其他国产大模型厂商的新模型（如 Qwen3-Max-Preview）一样，向曾经的王者 Claude 的传统优势区间发起挑战，强调智能编程领域的性能提升。

从技术细节上来看，Kimi-K2-0905 沿用了目前主流的 MoE 架构，参数规模为万亿级别，在推理时实际被激活的参数为 320 亿。

^参数概览

从该模型与 Claude Sonnet 4 在 SWE-bench Verified 等真实编程基准的对比中发现，Kimi-K2-0905 在部分测试中（如多语言环境、命令行 / 终端交互）甚至超过了这个竞争对手。

实战表现究竟如何？我们用它做了个经典小游戏。

指令很简单：「制作一个和微信打飞机类似的网页小游戏，需要美观，好玩，功能齐全。」

^{Kimi-K2-0905 生成游戏代码（部分截图）}

在网页端实现的效果堪称惊艳，不仅实现了浩瀚星空的背景，高速移动的拖影，概率出现的回血道具，还有不同颜色的敌人爆炸效果，甚至玩得好的话还有连击加分。

我们试着玩了好一会儿，困难模式真的挺难的。

根据知名博主「karminski - 牙医」的测试，Kimi-K2-0905 前端水平有了显著的提升，空间理解能力和召回能力都有所增强。

在需要生成超过一千行代码的「鞭炮连锁爆炸测试」中，Kimi-K2-0905 表现优秀。

^{原贴地址：https://x.com/karminski3/status/1963834619276709933?s=46}

Kimi-K2-0905 此次还在 API 定价上打出了竞争性优势。

据我们了解，Kimi 开放平台上架的 kimi-k2-0905-preview 模型 API，定价与上一代一致，计费方案为缓存未命中时每百万输入 tokens/4 元，缓存命中时每百万输入 tokens/1 元，每百万输出 tokens/16 元。详细的定价策略参考下图：

以美元计价的价格与国内价格比较接近。

相较于 Anthropic 堪称夸张的定价，Kimi 等国产编程模型称得上是「开源 Claude 平替」，并且能够实现全方位兼容 Anthropic API 和 Claude Code，延续开发者曾经的使用习惯。

尤其是在 Anthropic 对国内和其他地区「断供」的大背景下，让现有项目和工作流平稳落地的重要性不言而喻。

结语

在 AI 编程领域，国内的 AI 厂商都有自己的理解。大概分为两个方向，一部分厂商在产品和用户体验侧发力；另一部分则是打磨基础模型。

例如腾讯和字节对自家编码产品的更新主要集中在产品侧，字节更新 Trae Solo 版本、腾讯发布 CodeBuddy IDE 等等，都是试图超越 Cursor 核心竞争力的尝试。

与之对应，以月之暗面为代表的 AI 新势力，选择了一条更为直接的发展道路：通过技术创新与极限性能打磨，力求在大模型核心能力上与国际一线厂商（如 Anthropic）一较高低。

无论是上下文窗口的持续扩展，还是针对真实编程任务、Agent 工具调用等的专门优化，国内玩家正在取得逼近甚至超越海外同类产品的表现。

同时，主流 AI 编程工具，如 Cursor、Windsurf、Trae、Cline 等，以及第三方 Agent 产品，如 flowith 和 Genspark 等，也都在主动接入国内优秀的大模型，中国 AI 新势力已深度融入主流开发与应用生态。

如今，国产大模型不仅能在性能参数上赶超国际领先者，也能在实际开发体验上获得更多认可。这样的「正反馈循环」一旦形成，则有望快速积累开发者口碑，创建更繁荣的应用生态，进一步撬动更广阔的市场。

]]>

动态列表

Claude不让我们用！国产平替能顶上吗？

类别

资源

联系我们