动态列表

  • 刚刚!谷歌内部揭秘Genie 3:Sora后最强AI爆款,开启世界模型新时代
  • 硬核拆解!从GPT-2到gpt-oss,揭秘大模型进化关键密码
  • 黄仁勋子女逆袭上位!4万亿「皇储」成长史首曝:一个学烘培,一个开酒吧
  • GPT-5首次会推理,OpenAI联创曝AGI秘诀!超临界学习吞噬算力,2045金钱无用?
  • 400万人围观的分层推理模型,「分层架构」竟不起作用?性能提升另有隐情?
  • CoRL 2025|隐空间扩散世界模型LaDi-WM大幅提升机器人操作策略的成功率和跨场景泛化能力
  • SEAgent:开启从实战经验中自我进化的GUI智能体新纪元
  • OpenAI估值达5000亿美元;「原道」联手小岛秀夫,推《死亡搁浅》耳机;苹果手表将「大幅重新设计」
  • 奥特曼神秘晚宴讲话曝出!OpenAI的CEO或将是个AI,Chrome我也想买
  • 最惨就业季!CS学霸GPA 3.98,投2500份简历仅10次面试,AI吞噬入门级岗位
  • Yann LeCun最新纪录片首曝!传奇AI教父的双面人生,深度学习幕后40年
  • 大模型如何推理?斯坦福CS25重要一课,DeepMind首席科学家主讲
  • 当AI比我们更聪明:李飞飞和Hinton给出截然相反的生存指南
  • 简单即强大:全新生成模型「离散分布网络DDN」是如何做到原理简单,性质独特?
  • Sam Altman:AI存在泡沫;宇树机器人夺金,王兴兴:用遥控追求极致速度;蔡浩宇AI游戏上架,27.19元|极客早知道
  • 吞下17亿图片,Meta最强巨兽DINOv3开源!重新定义CV天花板
  • 打开高德的理由又多一条!全球首个「需求链智能调度」AI地图上线
  • 核心模型被曝蒸馏DeepSeek?前女友一纸控诉,曝出欧版OpenAI塌房真相!
  • 一句话搞定多任务出行,高德用空间智能重新定义地图
  • GPT-5、Grok 4、o3 Pro都零分,史上最难AI评测基准换它了
  • 谷歌开源Gemma 3 270M,性能超越Qwen 2.5同级模型
  • 追剧不断网,可能背后有个AI在加班,故障诊断准度破91.79%
  • Meta视觉基座DINOv3王者归来:自监督首次全面超越弱监督,商用开源
  • 多突触神经元模型问世,国内团队打造类脑计算新引擎,登上《自然·通讯》
  • Science封面:高效精准模拟构象变化,微软研究院用生成式AI重塑蛋白质功能研究
  • 扎克伯格看OpenAI直播挖人,北大校友孙之清加入Meta
  • AI 模特时代到来:字节x清华推出商用级视频换装模型DreamVVT,保真度显著领先SOTA
  • LeetCode刷够100小时,学会找人内推,OpenAI员工下场教你拿Offer
  • xAI元老离职干风投,传奇人物Babuschkin长文追忆与马斯克创业战友情
  • 链式思维是幻象吗?从数据分布视角重新审视大模型推理,马斯克回复,Grok破防
  • 李想:i8 反响不错,产品力没对手;库克暗示:苹果将推桌面机器人;中国日均消耗 30 万亿 Token,暴涨 300 倍
  • ChatGPT会让大脑退化?OpenAI高管用它救下自己「读写障碍」的女儿
  • 谷歌超级编码智能体正式上岗!125刀大会员,每天300任务任意跑
  • Meta华人天才毕树超「叛逃」预言:OpenAI未竟交互革命,暗藏万亿赛道
  • 美国CS就业梦碎!狂投5000家0 Offer,名校毕业00后被麦当劳惨拒
  • 3 分钟,我学会了像鸟儿一样飞行 | New Things
  • 从隐私计算迈向六大数据流通全栈技术,“隐语”开源社区升级
  • 7天,一场风暴!理想 i8「刮骨疗毒」,怒砍两个版本
  • 小订过万!打死不说价格的全新小鹏 P7,用颜值吊起了所有人的胃口!
  • 对话理想智驾负责人:撕掉「奶爸车」标签,智驶是理想的「新引擎」
  • 告别「偏科生」时代!36 万的坦克500,让对手从此无路可走
  • 万字长谈王小川:不再迎合他人做学霸,我要解自己的命题
  • 刚刚,全网最懂图文调研的智能体模型震撼上线,看完我直接卸了浏览器
  • ICCV 2025 | HVPL:分层视觉提示学习,让“视频实例分割”模型告别灾难性遗忘
  • 复旦&微软提出StableAvatar: 首个端到端“无限时长”音频驱动的人类视频生成新框架!
  • 千支队伍争锋!首届「启智杯」算法大赛圆满落幕,助推AI应用落地
  • 冗长响应缩减80%,DeepSeek GRPO获得颠覆性改进,微软GFPO问世
  • ICCV 2025 | HERMES:首个统一3D场景理解与生成的世界模型
  • 苹果 AI 下半场:年底问世的新 Siri,要彻底改变 iPhone 的交互
  • GNN+KAN,把三角函数当「激活」选项,山大、南洋理工让分子图更会读化学子结构
  • 港大联手月之暗面等开源OpenCUA:人人可造专属电脑智能体
  • 破解「长程智能体」RL训练难题,腾讯提出RLVMR框架,让7B模型「思考」比肩GPT-4o
  • AI独角兽498家,估值2.7万亿美元;《王者荣耀》连续三年成全球最吸金手游;抖音测试「快递」服务|极客早知道
  • 奥特曼公然叫板马斯克!重金杀入脑机接口,硅谷两大巨头彻底决裂
  • AI女友24h陪玩,全球800万人上头!这群AI创企靠百度开挂
  • 马斯克删除xAI「研究员」职位引爆网络!LeCun怒批:如此暴力将扼杀创新
  • OpenAI女CEO太狠了!智商148,GPT-5才是真印钞机
  • AI 和海外游戏发力,腾讯重回 7000 亿美金
  • 博士申请 | 休斯敦大学计算机系刘锦阳老师招收高性能计算/数据压缩方向博士生
  • Kimi K2背后的冷门绝招:海量语料“重写”如何榨干每个token?
  • ICML 2025 | 奖励模型还用人标?APEC用对抗模仿生成偏好,泛化能力直线上升
  • Attention Sink的起源找到了?清华×美团首次锁定MoE中的「超级专家」
  • 告别Transformer,重塑机器学习范式:上海交大首个「类人脑」大模型诞生
  • AI 上新|在 Edge 浏览器里,我第一次感受到了 AI 的「人味」
  • Agent狂欢下的冷思考:为什么说Data&AI数据基础设施,才是AI时代Infra新范式
  • AI顶会模式出了问题? 「不发表,就出局」的恶性循环,正在压垮整个AI学界
  • 研究者警告:强化学习暗藏「策略悬崖」危机,AI对齐的根本性挑战浮现
  • 多模态大脑建模技术迈入新纪元:Meta 10亿参数模型获Algonauts 2025大脑建模竞赛冠军
  • OpenAI没开源的gpt-oss基础模型,他去掉强化学习逆转出来了
  • 当人们怀念 GPT-4o,他们在「怀念」什么?
  • IEEE TPAMI 南洋理工&哈工大提出 MARCONet++ 攻克中文文本图像超分难题
  • 耶鲁&大连理工&南洋理工等提出MDCNeXt:X射线下的“动力电池缺陷精准检测”新范式
  • 6秒造一个「视频博主」,Pika让一切图片开口说话
  • 破解AI创企的「不可能三角」,解药不止「大模型」
  • OpenAI和奥特曼将投资一家脑机接口公司,直接与马斯克的Neuralink竞争
  • 大型语言模型稳定强化学习的新路径:几何平均策略优化GMPO
  • 传 DeepSeek-R2 8 月发布;微信测试信用借款功能;Perplexity 要 345 亿美元收购 Chrome
  • 一觉醒来,GitHub没了?CEO辞职,微软接管,开发者天塌了
  • AI全国榜单爆冷,全网吃瓜大狂欢!这家黑马竟靠DeepSeek杀进全国TOP 2
  • 物理学「AlphaGo时刻」?40年未竟之事被AI一举攻破,顶尖物理学家集体傻眼
  • 刚刚,商汤内部两万字复盘曝光:多模态通往AGI核心路线首次公开
  • 让强化学习快如闪电:FlashRL一条命令实现极速Rollout,已全部开源
  • 从物竞天择到智能进化,首篇自进化智能体综述的ASI之路
  • 破解效率与成本难题:华为UCM技术推动AI推理体验升级
  • SIGGRAPH上,英伟达发布物理AI开源新技术,更新RTX Pro产品线
  • 身家25亿刀,是四家公司创始人,这位伯克利教授还在给本科生上课
  • 商汤王晓刚:世界模型将加快AI从数字空间进入物理世界,「悟能」想做那个桥梁
  • 北京内推 | 度小满金融视觉和多模态团队招聘视觉多模态算法实习生
  • 实验室抢显卡抢破头?A800/H800骨折价来袭,超值返券助你轻松冲DDL!
  • 后训练轻量「小枝」强势出击!极限剪裁视觉token,推理加速154%
  • ICCV 2025 | LightSwitch:CMU提出材质引导的扩散模型,2分钟实现高质量三维场景重打光
  • TCSVT 2025 | 跨模态学习助力复杂工业过程异常检测:FmFormer框架与基准测试新突破
  • AI全面挖掘微蛋白价值:首次引入合成负样本训练,剔除92%噪声,摆脱保守依赖
  • 是「福尔摩斯」,也是「列文虎克」,智谱把OpenAI藏着掖着的视觉推理能力开源了
  • 东方理工·甬江论坛|新大学、新使命,邀你共启未来
  • LLM总是把简单任务复杂化,Karpathy无语:有些任务无需那么多思考
  • ICCV 2025 | 小红书AIGC团队提出图像和视频换脸新算法DynamicFace
  • 聚焦前沿,见证未来!「X·创新』产品SHOW圆满举办!
  • 刚刚,OpenAI拿下IOI金牌,仅次于前五名人类选手!参赛推理模型才夺得IMO金牌
  • Lumina-mGPT 2.0:自回归模型华丽复兴,媲美顶尖扩散模型
  • 雷军:小米YU7改名,被误会是丐版;传淘宝闪购周末峰值超美团;低价 MacBook 或年底亮相,599 美元
  • OpenAI开源霸权5天终结,百川M2一战夺冠!实测比GPT更懂中国医疗
  • 硅谷精英放弃生娃!MIT女记者揭秘:人类只是AI垫脚石,世界很快就毁灭
  • 41个榜单SOTA!智谱最新开源GLM-4.5V实测:看图猜地址、视频秒变代码
  • 2025全球大模型应用报告:红海混战「忠诚度」瓦解,用户脚踏4.7条船!
  • 昆仑万维发布新模型 SkyReels-A3,开启五天技术发布周
  • 世界机器人大会:笨拙的今天,与狂奔的明天
  • 「一只手有几根手指」,你的GPT-5答对了吗?
  • 4D空间智能:AI如何一步步「看懂」时空结构?一篇综述解析通往四维世界的五大层次
  • 智谱终于发布GLM-4.5技术报告,从预训练到后训练,细节大公开
  • 从捍卫者到引路人,上交&上海AI Lab提出LEGION:不仅是AI图像伪造克星,还能反哺生成模型进化?
  • ICCV 2025 | 机器人自主探索未知复杂空间?GLEAM破解主动探索建图的泛化难题
  • 脑子比不过AI,手也要沦陷了?这只灵巧手看得我有点慌
  • 第二届 “兴智杯” 全国人工智能创新应用大赛专题活动明天开启,技术解析 + 资源对接一站式平台重磅来袭!
  • 机器人上下文协议首次开源:阿里达摩院一口气放出具身智能「三大件」
  • Attention Sink产生的起点?清华&美团首次揭秘MoE LLM中的超级专家机制
  • 具身智能技术与应用论坛圆满举行,北京人形公布多项创新成果
  • ACL 2025 | 湖南大学、腾讯生命科学实验室等提出蛋白互作预测新方法,让LLM学会解读蛋白质网络
  • 宇树、银河通用都在用:英伟达「物理AI」技术亮相世界机器人大会
  • CVPR 2025 | DPC:用于微调视觉-语言模型的双提示协作
  • ICCV 2025 | 终结灾难性遗忘!南大提出外部知识注入机制,刷新CLIP持续学习SOTA
  • 超越样本级RL!人大×快手提出ARPO:熵驱动Agent探索,多轮推理性能飙升
  • 北京/上海内推 | 盛大集团AI创新中心招聘大模型/Agent方向算法实习生
  • 毒液抗菌搭配深度学习,千万级数据组中筛得386条备选,91.4%体外验证成功

谷歌最新「0.27B」Gemma 3开源!身板小却猛如虎,开发者直呼救命稻草



  新智元报道  

编辑:元宇
【新智元导读】大模型越来越大,开发者的「算力焦虑」也越来越严重。谷歌的Gemma却另辟蹊径:模型不求大,够用才是王道。Gemma 3系列,尤其是新成员Gemma 3 270M正是这一理念的最佳诠释者。它虽然「身板小」,却能承担各种AI实战任务,还能「组团」一起干大事。

大块头不等于大智慧。

这在生成式AI领域,已逐渐成为共识。

Gemma 3系列的成功就是一个很好的例证。

在过去几个月,是Gemma 3系列开源模型的高光时刻。

先是Gemma 3和Gemma 3 QAT,在云端和本地桌面加速器上,均跑出了SOTA级别的表现。

紧接着,主打「移动优先」的Gemma 3n完整版,将强大、实时的多模态生成式AI直接带入边缘设备。

上周,Gemma系列模型的总下载量突破了2亿大关,Gemmaverse社区的热度空前高涨。

Google又乘势推出了Gemma 3 270M。

看名字中的「M」就知道,它的目标不是「通吃一切」,而是要以更低成本、更高效率、更快速度地完成你交给它的活。

小身板,真能打


Gemma 3 270M是Gemma 3系列中参数规模最小的。

别看它个头小,能量却不可小觑。

在IFEval基准测试上,Gemma 3 270M树立了性能新标杆。

它的IFEval分数接近50%,显著高于一些相同尺寸甚至更大尺寸的模型。

在小模型阵营里,它是唯一接近50%水平的,意味着它在指令跟随任务中表现非常突出。

再加上其出色的文本结构化能力,让它更适用于面向特定任务的微调,从而在端侧部署和科研应用方面均展现出独特优势。

在效率上,Gemma 3 270M在中小模型中表现最优,甚至超越了更大规模的Qwen 2.5 0.5B和SmolLM2-360M;但与1B级别的模型相比,仍有20~25个百分点的IFEval差距:这是极致压缩带来的不可避免损失。

综合来看,Gemma 3 270M重要的性能亮点有:

小体积,强架构:模型中的1.7亿参数用在词嵌入层,支持256k超大词表,能识别冷门Token,适合细分行业和语言环境下微调使用。剩下1亿参数,则用于Transformer块;

省电狂魔:Google在Pixel 9 Pro上实测,INT4量化版本进行25轮对话只耗0.75%电量,是迄今最节能的Gemma模型;

跟指令超听话:除了预训练版本外,Google还放出了指令微调模型,开箱即用,能直接处理常规的指令类任务;

量产级QAT支持,部署无忧:模型提供了量化感知训练(QAT)版本,可在INT4精度下运行,性能几乎无损,特别适合资源受限设备的部署需求。


用对AI,才能事半功倍


「挂一幅画,你会用铁锤吗?」

这句话提醒我们:用对AI才能事半功倍。

不是每个AI项目,都需要动用几十亿参数的大模型(大锤),更多情况下,像Gemma 3 270M这样的小模型,反而是你需要的那把「AI扳手」。

Gemma 3 270M推出,正是延续了该系列模型「用对工具」的理念。

它是一款「开箱即战」的高性能基础模型,正如上文在它的性能亮点中提到的,出色的指令跟随能力,经过简单微调后,便可以在文本分类、数据抽取等任务中游刃有余。

此外,它还能直接部署在手机,或者树莓派这样的单片机电脑上。

有了这样一个小而强、易部署的模型作为起点,开发者可以打造轻量、快速且极具成本优势的生产系统。

Plaito AI的CTO Greg Mars对Gemma 3 270M颇为赞赏,认为它可以在自己的M4 Pro上极其快速、高质量的运行。

LLM研究工程师Sebastian Raschka,还贴出了Gemma 3 270M和Qwen3 0.6B的并排比较。

他认为最大的惊喜是Gemma 3 270M只有4个注意力头。

和Qwen3 0.6B的16个注意力头相比,Gemma 3 270M只有4个注意力头,这意味着后者在推理时key/value复用率高,显著降低显存占用和延迟。

因此,Gemma 3 270M更适合部署在低配的本地环境。

虽然Gemma 3 270M刚刚发布,但Gemma 3系列在不同规模的任务中,早已展现出「小而专」的威力。

例如,Adaptive ML与SK Telecom合作解决复杂多语言内容审核的难题时,并没有依赖庞大的通用模型,而是选择了微调一个Gemma 3 4B模型。结果不仅达标,甚至超越了更大体量的专有模型。

Gemma 3 270M延续了这一理念,将「小而专」进一步压缩到极致,把高效、精准的特性下放到更多开发者可直接使用的规模。

比如,你可以用它构建一个「多模型小分队」,每个模型专攻一类任务。

但别以为这种小模型只能用在「单调的」企业系统里,它的专业化能力,同样也能在创意领域干点有趣的事。

例如,Hugging Face的开发者Joshua,就用Gemma 3 270M搞了个基于Transformers.js的网页应用,生成睡前故事,支持离线运行,还能个性化生成角色和情节。

270M,是谁的「理想型」


Gemma 3 270M承袭了Gemma系列的先进架构与强大预训练,具备打造定制应用的理想基础。

如果你的应用场景与下列条件类似,那它就是你的「理想型」:

任务明确、数据量大的场景:如情感分析、实体识别、查询路由、结构化转换、创意写作和合规检查类任务;

预算有限,对响应速度有高要求:模型微调后,可运行在轻量、低成本的本地或终端设备上,能帮你省下大模型的推理成本,速度更快;

希望快速迭代和上线:它可以小时级别完成微调实验,远快于大模型的开发周期;

需要本地部署,保证隐私:Gemma 3 270M支持完全本地化运行,用户数据无需上传云端;

构建多个小模型一起跑:一台设备上部署多个任务专家模型也不吃力,控制预算的同时实现模型能力最大化。


Gemma 3 270M采用与其他Gemma 3模型一致的架构,并配套提供微调方法与工具,帮助开发者轻松将其打造成自己专属的解决方案。

下载模型:Hugging Face、Ollama、Kaggle、LM Studio、Docker全平台覆盖,可以获取预训练模型及指令微调版本;

试跑体验:在Vertex AI或llama.cpp、Gemma.cpp、LiteRT、Keras、MLX等主流工具上都能玩;

开始微调:使用Hugging Face、UnSloth、JAX等你熟悉的工具开展微调;

部署上线:微调完成后,可部署到本地环境、Google Cloud Run,或任意你选择的平台。


Gemmaverse的核心理念是:创新无关大小。

Gemma 3,尤其是Gemma 3 270M,是开发者构建「专精小模型舰队」的理想起点。虽然它们身板小,却能承担起各种AI实战任务,组团干大活一点也不含糊。

Gemma 3:开发者手中的「瑞士军刀」


2024年2月,Google推出了Gemma系列的首个版本。

作为Gemini的轻量级版本,Google推出它的初衷很简单,让开发者不再为「模型太大跑不动、模型太小能力不够」而纠结。

Gemma 3上线后,「开源友好」「性价比高」「可塑性强」是众多开发者对它的一致评价,俨然已成为开发者AI工具箱里的「瑞士军刀」。

大模型越来越大,随之而来的是越来越严重的「算力焦虑」,市场对于低硬件需求且效能强劲的AI解决方案始终存在着巨大需求。

「模型不求大,够用才是王道」。

Gemma系列的这一设计理念,正是对上述市场趋势的积极回应,这次Gemma 3 270M的发布,更是将该理念推向一个新的阶段。

参考资料:

https://developers.googleblog.com/en/introducing-gemma-3-270m/

https://huggingface.co/google/gemma-3-270m

https://www.youtube.com/watch?v=qcjrduz_YS8

https://ikala.ai/zh-tw/blog/ikala-ai-insight/gemma-3-intro/



<br>


    <a class="media_tool_meta meta_primary" href="http://mp.weixin.qq.com/s?__biz=MzI3MTA0MTk1MA==&amp;mid=2652620536&amp;idx=3&amp;sn=b10de35314cd5b7da657f5cd55cd03ab&amp;chksm=f0f0f47e388f59092949d971a09d95759c0b24a7737442fc8f4baa104d2d557e31e0dbfba3ac&amp;scene=0#rd"  target="_blank">文章原文</a>
    <br>




<img alt="" class="" height="1px" src="https://images.weserv.nl/?url=http://www.jintiankansha.me/rss_static/83671/iAa95A4zVY&amp;maxage=1y"  width="1px"></div></div></body></html>

联系我们