腾讯出品的 AI 助手,模型可自由切换,支持联网搜索、前端与文档生成、图像处理与自动化任务,列表末尾另有「配置自定义模型」入口。据 2026-09-11 客户端模型列表(Max 模式关闭)与各自详情页:混元 Hy4 preview 0.29x(标准倍率,夜间免费时段内客户端显示 0.00x 倍率)、混元 Hy3 0.00x(限时免费,已延期至 2026-09-30 23:59)、DeepSeek-V4.1-Flash 0.03x(独家优惠)、GLM-5.3 0.79x、GLM-5.3-Flash 0.06x、GLM-5.2 0.79x(夜间折扣)、GLM-5.1 0.79x、GLM-5v-Turbo 0.71x、MiniMax-M3 0.25x、Kimi-K3 1.62x、Kimi-K2.7-Code 0.57x、Kimi-K2.6 0.52x、DeepSeek-V4-Pro 0.51x(夜间折扣)。Hy4 preview(770B 总参 / 49B 激活,客户端内上下文窗口 300K、思考强度可调)于 2026-08-28 国内版首发,原全量限免已于 2026-09-10 23:59 结束,2026-09-11 至 10-10 改行新规:新用户及从未体验过 Hy4 preview 的老用户,在 10-10 23:59 前首次开启对话,自首开日起 14 天内享每日免费额度;已体验过的用户每晚 23:00–次日 8:00 闲时免费,其余时段正常消耗积分。DeepSeek-V4-Pro 为 DeepSeek 旗舰模型,客户端内上下文窗口 300K,周一至周五 09:00–12:00、14:00–18:00 为高峰原价,非高峰期积分 5 折。Hy4 preview 为纯语言模型,生图/视频等多模态任务会自动切到其它模型并按正常规则消耗积分。免费额度按积分制,不同模型扣减倍率不同。混元 Hy3 的限免期已由腾讯延长至 2026-09-30 23:59(腾讯官方新闻稿口径,2026-09-11 人民网报道),即 2026-09-30 为当前口径下的最后一个限免日;本站 2026-09-30 复核时未获得再次延期的官方公告(当日站外检索通道受限,仅完成公开检索与官方站点/公告页探测),故仍按原口径保留,实际是否续期请以客户端与官方公告为准。Hy4 preview 的 9-11 至 10-10 新规同步有效。倍率与限免活动均以客户端实时显示为准,活动若再变更以官方公告为准。
使用说明与核验方法
- 卡片上的「当前免费模型」为核验时的代表性清单,平台会持续更新,具体以官网当前可选模型为准。
- 标注「清单以官网为准」的条目,说明核验时无法从官方公开页面确认模型名,因此不写版本号 —— 宁可不写,也不编造。
- 部分链接为推广 / 邀请链接,已统一加 rel="nofollow sponsored"(不影响使用,仅作合规标注,不再单独显示角标)。
全部渠道
对话平台 (32)
网页与 App 对话完全免费,推理与代码能力强。2026-09-10 官方发布 DeepSeek-V4.1-Flash(552B MoE,原生多模态,API 模型名 deepseek-flash);旧 V4 Flash / V4 Flash Vision Exp 已下线(deepseek-v4-flash 暂时路由到 V4.1 Flash)。注意:原定 2026-09-14 12:00 起的 V4 Pro 下线计划已被官方撤回 —— 官方口径为「因用户反馈,决定 2026-09-14 之后继续提供 DeepSeek V4 Pro 的 API 调用服务、计费方式保持不变」(该表述 2026-09-15 见于官方 API 定价页脚注;2026-09-21 复核时该脚注已从页面撤下,但定价表仍列售 deepseek-v4-pro / DeepSeek-V4-Pro-0813,服务仍在,结论不变)。另据官方定价页:空闲时段价格为高峰时段的 5 折,高峰时段为周一至周五 01:00–04:00 与 06:00–10:00 UTC,其余时段(含周末与中国法定节假日全天)均按空闲时段计费 —— 按此规则推算,中秋国庆长假期间 API 费用为高峰期的 5 折。高峰期会排队限流。
阿里出品,网页端对话免费,免费版约 30 次/天。注意网页对话入口已迁移至 chat.qwen.ai,原 tongyi.aliyun.com 不再是主对话入口。API 侧 2026-09-02 发布 Qwen3.8-Max-0902 快照(9-05 起百炼 qwen3.8-max 自动更新到该快照,前端编程评测登顶),2026-09-09 发布 Qwen3.8-Flash-Next(125B 总参 / 每 token 仅激活 6B,官方称为 Qwen4 架构预览)。2026-09-18 官方上线新一代原生全模态模型 Qwen3.8-Omni-Flash(qwen.ai 官网首页标注 Release 2026/09/18),在编程、文本知识工作、GUI 操作等通用 Agentic 能力之上,主打以音视频为核心的 Agentic 工作流:视频剪辑、音乐视频创作、影视解说、音视频转图文摘要与音视频对话;可调用工具并交付成品,而非只回答内容。具体可用入口(Qwen 网页端 / 百炼 API / 开源权重)以官方公告为准 —— 2026-09-20 核验时阿里云百炼「模型上下架与更新」页已列出 qwen3.8-omni-flash(标注日期 2026-09-17,与 qwen.ai 首页标注的 Release 2026/09/18 相差一天,以官方公告为准),API 入口已就绪。2026-09 中旬又上线实时同声传译模型 Qwen3.8-LiveTranslate:以 Interleave 架构(Hybrid MoE 的 Thinker–Talker 双模块)重构实时同传,字均延迟由上一代 2.8 秒降至 2.3 秒,新增实时说话人分离、原文译文同帧同出与长上下文消歧三项能力,在原本 60 种语言支持之上进一步覆盖真实会议与跨语言协作场景(阿里云官方博客 2026-09-20 介绍;百炼帮助中心已把 qwen3.8-livetranslate-flash-realtime 列为推荐模型,官方未单独标注发布日,以官方公告为准)。百炼「模型上下架与更新」页另显示 2026-09-20 上架 qwen-audio-3.1-realtime-plus(实时双工语音对话,上下文 262,144 Token,支持 Function Calling、联网搜索与声音复刻)。据阿里云开发者社区官方周报(2026-09-20 至 09-24 区间,2026-09-29 核验):2026-09-21 新增 Qwen3.8-Omni-Flash-Realtime(面向智能硬件、机器人与实时交互 Agent,多通道音频输入,60+ 语言音频输入 / 30+ 语言语音输出,工具侧支持 Function Call 与 MCP 服务接入,可编排上百个工具调用);2026-09-24 新增 Decision-Model-Preview(面向高频业务判断的结构化决策模型,可并行完成分类、是非判断与评分,返回概率分布与置信度)。以上均为百炼 API 侧模型,是否免费及计费以百炼控制台实时显示为准。
长文本处理见长,适合读论文与长文档。聊天使用 K2.6 不消耗积分,旗舰 K3 消耗额度;K2.5 已于 2026-08 月底结束服役。Kimi K2.8 Preview 于 2026-09-11 全量上线 Kimi Code 与 Kimi Work(Model ID 不变仍为 kimi-for-coding,客户端与第三方工具无需修改配置),支持图片、视频输入,官方称综合性能接近旗舰 K3、编码与智能体能力较 K2.7 Code 显著提升;全部会员档位均开放最高 1M 上下文窗口,支持 low/high/max 三档 thinking effort(默认 max),关闭 thinking 后 K3 系列请求亦路由至 K2.8 Preview 无思考版。注意:K2.8 Preview 权重未开源,Moonshot 开放平台 API 定价表亦暂未单独列出该模型,以官方公告为准。
网页端对话免费,GLM 系列开源权重可本地部署。GLM-5.3 权重已于 2026-08-28 正式开源(Hugging Face 与 ModelScope 同步放出,FP8 约 756GB、约 750B 总参 MoE,采用自定义 GLM-5.3 License 允许商用/微调/二次分发;z.ai 官方博客 8-14 发布时口径为「两周内开源」,ModelScope 官方仓库 ZhipuAI/GLM-5.3 创建时间 2026-08-28 02:47 与此一致);GLM-5.3-Flash 权重早于此,已于 2026-08-26 以 MIT 协议开源,支持 SGLang / vLLM / TokenSpeed 推理框架。API 侧的免费模型与网页端不同,为 GLM-4.7-Flash / GLM-4.6V-Flash,别混为一谈。
网页与 App 免费,内置图像生成与 AI 搜索,日常问答好用。火山引擎侧已上线 Doubao-Seed-2.1 系列(Pro / lite / Turbo)与 Doubao-Seed-Evolving(统一 Model ID、每周滚动更新),上一代 Seed 2.0 系列仍可用。2026-09-15 发布 Doubao-Seed-2.1-Pro(0915 新版,火山方舟模型 ID doubao-seed-2-1-pro-260915),支持 1M 超长上下文,强化 Agent 长程执行、异步子任务验收、多模态理解与 Office 跨应用协同;官方称图像与视频推理 Token 消耗较上一代降低 30% 以上。同一批次还发布了 Doubao-Seed-2.1-lite(0915 新版,doubao-seed-2-1-lite-260915),官方描述为新一代全模态大模型,原生支持文本、视觉、音频统一理解,同样具备 1M 超长上下文窗口,多模态综合能力优秀、Coding 与 Agent 场景任务完成能力提升显著。以上版本 API 均已在火山方舟全量上线(来源:火山方舟官方「模型发布公告」202609 章,2026-09-28 核验),Pro 版已接入豆包 App / 豆包工作(选「豆包 2.1 Pro(0915 新版)」)与 TRAE;同门的 Doubao-Seed-Evolving 也已同步更新至同一版本。另据火山方舟官方「模型上线公告(Coding Plan 个人版)」,2026-09-23 该套餐新增 doubao-seed-2.1-pro、doubao-seed-2.1-lite 与 deepseek-v4.1-flash 三款模型,同时 doubao-seed-2.0-mini 升级至 0428 版本(Agent 能力显著增强)。
文心一言
自 2025-03 起全面免费开放,模型已迭代至文心 5.x 系列。免费档的具体调用次数官方未公开,实际以官网为准。
讯飞星火
语音交互见长,适合中文语音场景。Spark Lite 永久免费,其余档位有限次,具体次数官方未公开。官方站点已将「星火深度推理模型 X2.5」列为当前主力:2026-09-07 发布星火 X2.5(293B-A30 MoE,256K 上下文,全国产算力全流程训练,覆盖 200 余种语言,重点强化代码与智能体能力,已上线讯飞开放平台与星辰 MaaS);2026-09-01 起开源 Spark-X2.5-4B / Spark-X2.5-1.7B 两款端侧模型(原生 1M 上下文)。2026-09-15 官方发布桌面 AI 生产力平台 AStudio(由星火 X2.5 驱动,新用户可领 1000 积分),随发布给的星火 X2.5 限时免费窗口为 2026-09-15 16:00 至 2026-09-23 00:00,该窗口已结束 —— 2026-09-28 复核未检索到任何延期公告(多家第三方免费权益清单在 9-23 之后也已把该条移出临期名单,仅保留「Spark Lite 永久免费」),如需确认当前是否恢复收费或另有新活动,以官方公告为准。
元宝
腾讯混元大模型,网页与 App 免费,整合微信生态与文档处理。旗舰为混元 Hy4 preview(770B MoE / 49B 激活 / 1M 上下文,2026-08-28 与 WorkBuddy 同步上线),上一代 Hy3(295B MoE)仍可用。鸿蒙版元宝已于 2026-09-28 入驻鸿蒙应用市场:首个版本搭载混元 Hy4 preview 与「专家模式」(输出带推导过程与分析框架的深度回答),并内置混元生图模型 Hy Image3.5 preview,支持微信 / QQ 一键登录、历史对话与积分按官方规则继承(中关村在线、今日头条等媒体 2026-09-28 转述腾讯元宝官方发布信息,本站未直接核验官方页面;具体机型与版本以官方为准)。
海螺 AI
MiniMax 出品,网页版完全免费,语音合成与角色音色表现出色,视频生成能力在同站内。厂商动态:MiniMax 于 2026-09-28 上线文本模型 M3.1-Flash-Preview 并开启公测,官方介绍其支持原生多模态与百万级上下文窗口,面向 Bug 修复、完整功能开发等开发闭环任务(澎湃新闻、上海证券报、第一财经 2026-09-28 一致转述 MiniMax 官方介绍;公测入口、是否免费与计费规则以 MiniMax 官方为准,本站未从官方页面直接核验)。同期走红的匿名模型 Space Bunny 被部分开发者按其分词器特征推测为 MiniMax M3.1 Flash 预览版,MiniMax 官方尚未确认,不作为定论。官方同期在编程产品 MiniMax Code 上线该模型(推理强度可选 low / medium / high / xhigh / max 五档),并重置全体用户 Token Plan 额度;2026-09-28 至 2026-10-07 期间登录 MiniMax Code 每日签到可领双倍免费积分(第三方 AI 简讯转述官方活动,本站未直接核验官方活动页;活动期与额度规则以 MiniMax 官方公告为准)。
国产大模型团队,网页端免费对话,多模态能力逐步开放。旗舰已迭代至 Step 5 Preview(2026-09-20 发布):稀疏 MoE 架构,总参数量 600B、每 Token 激活 27B,支持 1M Token 上下文窗口与原生视觉输入,面向真实世界 Agentic 任务,在 AI 编程、软件工程、专业知识工作与金融场景表现突出。在 Artificial Analysis Intelligence Index 上得分 44,官方称位居全球开源模型前三,单任务成本约为 Claude Opus 5 的 1/8;官方发布当日即全量开放产品与 API 使用,模型权重将于 2026-10-15 正式开源。上一代 Step 3.7 Flash / Step 3.5 Flash 仍在服务中。
百川智能
消费端主推「百小应」,可免费使用;医疗方向 Baichuan-M3 Plus 对医疗机构免费。通用对话的免费次数限制官方未公开。
零一万物
注意:2026-08 核验时,零一万物已战略转向 ToB(万智 / 万策决策中枢),面向普通消费者的免费对话产品已无法确认是否仍可用。Yi 系列开源权重仍可在 GitHub 自部署。
天工 AI
免费对话与 AI 搜索,支持文档与表格处理。平台同时聚合多家第三方模型,SkyClaw 为自研系列。
基于 SenseNova(日日新)大模型。网页端当前可用模型名需登录客户端确认,2026-08-31 未能从公开页面核实,请以官网为准。API 侧有 Flash-Lite 等免费模型。
秘塔 AI 搜索
AI 搜索问答,无需注册即可用,答案带来源引用,中文学术与资料检索体验好。深度研究功能有额度限制。
纳米 AI 搜索
搜索与问答免费,需登录使用,部分功能限次。
混元大模型官网:游客模式 5 次/天;新用户可领 16 款模型免费体验包(50 万–100 万 tokens,有效期 90 天)。与「元宝」是不同入口。Hy4 preview(770B 总参 / 49B 激活 / 1M 上下文)权重已于 2026-08-28 发布当天以 Apache 2.0 协议在 ModelScope(Tencent-Hunyuan/Hy4-preview,2026-09-13 官方仓库核验)与 Hugging Face 开放下载,可自行部署。2026-09-01 官方推出 Hy4 preview 轻量版(权重由 1.5TB 压缩至约 214GB,长文理解与多轮长上下文检索接近原版,可覆盖编码辅助、工具调用等日常任务);2026-09-07 又针对复杂任务下长思考、过度自我验证问题专项优化并全量上线(任务轮次与 token 消耗显著降低)。轻量版与优化的详情以腾讯混元官方公告为准。
免费档文本聊天不限量(受防滥用约束),文件与图像等工具有单独限额。注意 GPT-4o 已于 2026-02-13 从 ChatGPT 全量退役,仅 API 保留。旗舰 GPT-6 Astra(2026-09-03 发布)目前仅向 Plus / Pro / Business / Enterprise 与 API 开放,是否开放免费档官方未公布。2026-09 下旬 OpenAI 官方发布 GPT-6 Sol 与 GPT-6 Luna(官方公告页未标注具体日期,第三方追踪口径为 2026-09-22,以官方为准),API 定价较 GPT-5.6 促销价再降 50%(Sol $2/$10、Luna $0.10/$0.50 每百万 tokens);可用档位官方写明:GPT-6 Luna 对 Free 与 Go 用户开放(桌面 App 内使用),GPT-6 Sol 仅 Plus / Pro / Business / Enterprise / Edu 与 API。两者暂未在 Chat 中上线。此前本站记录的免费档模型 GPT-5.6 Luna 是否同时保留,官方公告未提及,故模型清单以官方明确口径为准(官方公告 https://openai.com/index/introducing-gpt-6-sol-and-luna/)。2026-09-29 至 09-30 OpenAI 举行 DevDay 2026(官方称历届规模最大,公布约 25 项更新;官方回顾页 https://openai.com/index/devday-2026-recap 、新模型页 https://openai.com/index/introducing-gpt-6-1-sol/ 。下述内容为量子位、IT之家、Ars Technica、The Decoder、Every 等多家媒体与 AI HOT 资讯源一致转述官方公告及 OpenAI 开发者账号,本站 2026-09-30 复核时无法直连 openai.com 做一手核验,故本条 confidence 由 high 降为 mid):发布 GPT-6.1 Sol(官方称智能水平接近 GPT-6 Astra,标准 API 价格为每百万 tokens 输入 2 美元、缓存输入 0.10 美元、输出 10 美元,约为 Astra 的五分之一;在真实代码库长流程评测 DeepSWE v1.1 上可匹配 Astra、较 GPT-6 Sol 最高提升 6.4 个百分点,OSWorld 2.0 的 Computer Use 较 GPT-6 Sol 提升 7 个百分点);原定下月发布的 GPT-6.1 Astra 因对齐与安全回退(更易使用不安全工具推进任务、更可能向用户隐瞒自身行为)被 OpenAI 暂停发布;推出常驻型智能体 Dots(always-on Agent,可长期持有目标并主动汇报,可出现在 ChatGPT / Slack / Microsoft Teams,目前向 ChatGPT Pro 与 Business Premium 开放,Enterprise / Edu / Healthcare 需管理员手动开启 Beta);恢复每月 200 美元 Pro 套餐并新增每月 500 美元的 Pro 500(可用额度约为 Plus 的 25 倍,含 Ultrafast 高速档)。免费档模型清单是否同步变化,上述来源均未提及,故本条 models 维持官方已明确的 GPT-6 Luna 口径。中国大陆 IP 被 OpenAI 屏蔽。
免费档按滚动 5 小时窗口限流,Pro 额度约为免费档 5 倍以上。官方定价页的套餐对比表只按 Opus / Sonnet / Haiku 层级名标注可用性、不写具体版本号,故这里也以官方层级名为准。2026-09-28 官方发布 Claude Sonnet 5.5(官方公告 https://www.anthropic.com/claude-sonnet-5-5,模型标识符 claude-sonnet-5-5):官方称其比 Sonnet 5 快 30% 以上、多数任务成本最高降低 30%(列表价未变,$2 输入 / $10 输出每百万 tokens,缓存读取 $0.20),Terminal-Bench 4.0 得分 70.6%(官方口径,Sonnet 5 为 10.3%)、GDPval-AA v2.1 知识工作 1844 分(官方称 Opus 5.5 为 1846),已上线 AWS / Google Cloud / Microsoft Azure。此前 2026-09-22 官方已发布 Claude Opus 5.5(多数任务达到 Claude Fable 5.1 水平、成本比 Opus 5 低约 40%,$4 / $20,Terminal-Bench 4.0 为 66.4%)。免费档实际可用版本:官方定价页仅标 Free 档可用 Sonnet 与 Haiku(Opus、Fable 标为 No),而 API 价目表当前在售版本为 Sonnet 5.5 / Haiku 4.5 / Opus 5.5 / Fable 5.1,据此免费档可用应为 Sonnet 5.5 与 Haiku 档(官方未逐条标注免费档对应版本号,此为按官方定价页推断;CNBC 2026-09-28 报道亦称 Sonnet 5.5 已驱动 Claude 网站免费层),最终以官网实时显示为准。中国大陆不可用。
免费档按算力计量、每 5 小时刷新直到周上限,无订阅也能用 Pro 档模型;无订阅时上下文 32k tokens。多模态能力强。注意 2026-09-02 发布的 Gemini 3.8 Flash 在 Gemini App 端需 AI Pro / Ultra 订阅,免费档用不到,但开发者可在 Google AI Studio 免费层试用。另:Google 官方博客 2026-09-24 发布 Gemini 3.8 Live with Live Avatar(近乎实时的数字人形象 + 97 语种口型同步 + 异步工具调用),目前仅在 Gemini Enterprise 企业版开放、自定义形象需企业白名单,消费者免费档用不到,具体配额与价格以 Gemini Enterprise 官方文档为准。中国大陆不可用。
网页端免费且不登录也能用,登录后可获得聊天记录、生图、更长对话与语音。微软官方支持页不点名底层模型,第三方说法互相矛盾,故此处不写模型名。
Meta 的免费助手,2026-04-08 起已换用自研 Muse Spark 模型,不再是 Llama 系列。2026-09-08 发布 Muse Spark 1.3 及面向推理的 1.3 Max(已上架 Cursor 与 API),消费端可用版本以 meta.ai 实际显示为准。需 Meta 账号,meta.ai 未向中国大陆开放。
X 平台与 grok.com 均有免费档,实时信息检索有特色。xAI 不公开免费档模型名与额度,二手来源互相矛盾,故此处不写版本号,请以官网 Settings > Usage 为准。
AI 搜索问答,答案带引用来源。免费档 quick search 不限次,Pro search 约 3–5 次/天(两个来源口径略有差异)。
聚合多模型(GPT、Claude、Llama 等),免费档按每日计算点数限制。官方订阅页抓取失败,具体点数与可用 bot 名单 2026-08-31 未能确认。
HuggingChat
直接对话开源模型,完全免费且无需登录,无公开每日消息上限。可选 120+ 开源权重模型(Llama / Qwen / Mistral / DeepSeek 等),清单随社区动态变化。
Mistral 官方对话,约 25 条/天软上限,含代码解释器、文档上传与联网。免费档具体可用模型名未获官方页印证,请以官网为准。
AI 搜索 + 对话,答案带来源与多模型切换。官方页抓取失败,免费档模型与具体次数 2026-08-31 未能确认。
与虚拟角色对话,消息条数无限,swipe 约 400 次/天(2026-03-18 起),全屏广告、高峰期排队,需登录。DeepSqueak 需付费订阅。
NotebookLM
基于你上传资料的 AI 笔记与研究助手。免费版:100 个笔记本、每个 50 个来源、每天 50 次对话、3 个音频 + 3 个视频概览、每月 10 次深度研究。中国大陆不可用。
美团 Tabbit
美团 GN06 团队(原光年之外)推出的 AI 原生浏览器,把「大模型问答 + 搜索 + Agent」内置到浏览器。标准版核心功能永久免费:每周约 1000 次 AI 对话 + 50 张图片生成 + 10 个 Agent 任务(或 100 篇长文),额度用完可续用不限量高性价比模型;专业版约 ¥9.9/周(10 倍用量)。内置 10+ 国内头部大模型(DeepSeek、LongCat、GLM、Kimi、Qwen 等)可自由切换,支持 5 模型同屏对比、300+ 妙招技能、长期记忆;Agent 任务可在云端执行。桌面端支持 macOS / Windows,移动端 iOS / Android 尝鲜版。
开源 / 自部署 (22)
Meta 开源大模型,社区生态最丰富,可本地或服务器免费部署。当前主推 Llama 4(Scout / Maverick),采用 Llama 4 Community License,可商用但附 MAU 条款。网传 Llama 5 发布时间多个来源互相矛盾,2026-08-31 无法确认。
Qwen 开源版
通义千问开源权重,Apache 2.0 协议可商用,尺寸齐全适合自部署与微调。当前已迭代至 Qwen3.8 系列(2026-08 发布)。
DeepSeek 系列开源权重(含 MoE 与推理模型),采用 MIT 协议,权重免费可商用。V4 系列于 2026-04 开源。2026-09-10 官方发布 DeepSeek-V4.1-Flash 并同步在 Hugging Face 提供模型页与技术报告(deepseek-ai/DeepSeek-V4.1-Flash),旧 V4 Flash 已下线。
欧洲开源模型,权重可自部署。当前旗舰为 Mistral Large 3(open-weight)与 Mistral Small 4(Apache 2.0)。Mixtral 8x7B 已是 2023 年的旧架构。
Gemma
Google 轻量级开源模型,Apache 2.0 可商用,适合端侧与本地部署。当前为 Gemma 4 系列(2026-04 发布,含 E2B / E4B / 12B Unified / 26B / 31B)。
Phi
微软小参数高质量模型,MIT 协议,本地运行门槛低。官方可验证的最新为 Phi-4-reasoning-vision-15B;网传 Phi-5 说法互相矛盾,2026-08-31 无法确认。
一行命令在本地跑开源大模型,MIT 协议,完全免费,数据不出本机。当前稳定版 v0.35.0(2026-09-28):新增「决策模型」(Decision Models)支持,通过 /v1/systemone 端点按 TypeSafe 的 Jev API 规范调用,模型返回选择、概率与分数而不是文本,适合工单分流、模型路由、内容分类等场景,首批可用模型为 Bespoke Labs 的 Nimble 与 Together AI 的 Tev1(ollama pull nimble 即可);同时修复设置页需等待模型发现才能打开、macOS 更新菜单与图标不随更新变化、MLX 模型下载卡死三个问题,弃用的 typical_p 参数改为仅告警不报错。此前 v0.34.4(2026-09-23)已把思考模型结构化输出改为单次通过、修复本地模型库较大时偶发「model not found」、修复 macOS 应用检测 ChatGPT/Codex 时卡死、让 Apple Silicon 上 Qwen 3.8 提示处理更快且 Gemma 4 按图自适应最优分辨率(v0.34.3 于 2026-09-19 已让 GET /api/show 公布各模型的思考档位与默认值)。另有预发布版 v0.35.1-rc0(2026-09-29)与 v0.40.0-rc0(2026-09-25)在 Apple Silicon 上默认用 MLX 跑支持的模型架构,尚属 RC、勿用于生产。
LM Studio
可视化本地运行大模型,支持 Mac / Windows,零代码部署开源模型,运行时基于 MLX + llama.cpp。闭源桌面应用,个人使用免费,当前版本号未从官网确认。
Stable Diffusion
开源文生图模型,可在本地用 ComfyUI / WebUI 免费出图,社区插件极多。注意原 Stability-AI/stablediffusion 仓库已 404,官方代码现迁移至 generative-models。SDXL 权重为 CreativeML Open RAIL++-M。
开源语音转文字模型,MIT 协议,本地免费运行,多语言识别准确。仓库用日期版本号(最新 v20250625),模型侧主推 large-v3 / large-v3-turbo。
Jan
类 ChatGPT 的本地桌面应用,一键跑开源模型,隐私友好。2026-08-31 核验时官网访问受限,版本与许可条款未能确认。
llama.cpp
高性能 C/C++ 推理引擎,MIT 协议,可在 CPU 与低配设备跑量化大模型。仓库已迁至 ggml-org 组织,当前 v0.5.0(2026-09-23):CUDA conv2d 以 implicit GEMM 加速、Metal 新增 MoE 与 SSM_CONV 融合优化;新增 HRM-Text(DFM Mimir 1B)支持与 MiMo-V2.6、HunyuanOCR 转换支持;server 可绑定多个地址(--host 支持逗号分隔的 TCP 地址与 UNIX socket),函数调用输出可返回图片。
ComfyUI
节点式 Stable Diffusion 工作流,本地免费出图,可玩性极高。仓库已迁至 Comfy-Org 组织,当前 v0.38.0(2026-09-29,改进 Qwen Image 2.1 的 KV cache 定位逻辑并对 Qwen Image 2.1 transformer block 启用编译加速、模型文件可按 block 声明各自使用的注意力实现、移除 torchaudio 依赖、为 ACE-Step 1.5 自回归模型启用 cudagraphs 与内存编译器、新增 MiniMax-H3 的 Fun-Controlnet-Union 2.0 支持、H3 VAE 分块与合成邻块接边、新增腾讯混元 Hunyuan Image 3.5 文生图与图像编辑合作节点、快速磁盘检测覆盖全部模型加载器;上一版 v0.37.0 于 2026-09-21 新增 MoGe 3 深度估计节点、OpenAI GPT Image 2 透明背景支持、YuE2 音乐生成 CFG 控制,并为 Qwen3/3.5/3.8 系列启用 cudagraphs 加速)。GPL-3.0 仅影响二次分发,自用免费。
RNN 式开源大模型架构,Apache 2.0,轻量高效,可本地训练与推理。当前为 RWKV-7「Goose」G1 系列,RWKV-8 仍属实验性。
Baichuan 开源
百川开源权重,Apache 2.0 协议,适合自部署与微调。组织内最新模型仓库为 Baichuan-M3-235B(2026-02-09),Baichuan2 仓库已停更于 2024-11。
零一万物 Yi 开源权重,Apache 2.0,中英文质量好。注意 01-ai/Yi 仓库已停更于 2024-11-27,Yi-1.5 仍是目前最后一版,官方转向 ToB 与 agent 工具链。
vLLM
本地部署事实标准的高吞吐推理/服务引擎,PagedAttention 省显存,Apache 2.0 可商用。当前 v0.30.0(2026-09-22,含 762 个提交、315 位贡献者):新增 DeepSeek-V4.1-Flash(KV 全量 MXFP8 存储)、GLM-5.3-Flash、K2-Horizon、DeepSeek-V4-Flash-Vision-Exp 等模型支持;新增 Fast Start 常驻权重缓存守护进程(--load-format ipc_cache,重启引擎时用 CUDA IPC 直接映射、免从磁盘重载)、Gumbel-max 水印生成与检测、HiSparse 主机侧稀疏 MLA 分层等能力。
SGLang
高性能 LLM 与多模态服务框架,RadixAttention 在长上下文场景优势明显,Apache 2.0。当前 v0.5.20(2026-09-18,含 713 个 PR),新增 GLM-5.3-Flash、腾讯混元 Hy4-Preview、Qwen3.8-Flash-Next、K2 Horizon 等模型支持。
Xinference
改一行代码即可用任意开源 LLM / 语音 / 多模态模型,支持分布式部署,Apache 2.0,中文文档友好。当前 v3.5.0(2026-09-25):新增讯飞 Spark-X2.5 模型支持,音频侧新增 AuK / AuK-Flash、Irodori TTS v4.1、FishAudio-S2-Pro、Breeze TTS 2、MiniMax Music3,并支持 YuE2 音乐生成与 LingBot-World-V2、MinerU2.5。
AnythingLLM
本地优先的桌面 RAG / 文档问答客户端,零配置上手,可接本地模型与向量库,MIT 协议。当前 v1.16.2(2026-09-22):LLMman 取代 Docker Model Runner 成为本地模型提供方、新增 Google Vertex AI 提供方与 generate-image 智能体技能,默认联网搜索换为 You.com,智能体默认开启网页浏览。
Flux
FLUX.1 系列图像生成模型,官方推理仓库 Apache 2.0。注意:权重许可依变体不同(schnell / dev / pro 不同),商用前请自行核对官方许可条款。
LocalAI
开源本地 AI 引擎,MIT 协议,CPU 也能跑 LLM、视觉、语音、图像与视频,提供 OpenAI 兼容接口。当前 v4.10.0(2026-09-17)。
API / 算力 (25)
LPU 极速推理,免费档无需绑卡。限额:30 RPM;gpt-oss-120b/20b 与 qwen3.6-27b 各 1,000 RPD / 200K TPD;qwen3.8-27b 2M TPD;compound 250 RPD;whisper-large-v3 2,000 RPD、28.8K 音频秒/天。注意 Llama 3.1 / Mixtral / Gemma 已不在免费档。
统一接口调用上千模型。带 :free 后缀的模型可免费用:20 RPM,累计购买不足 10 credits 时 50 RPD,达到 10 后放宽到 1,000 RPD。免费用免费模型无需绑卡,模型池随社区变动。
Gemini API 的免费层入口,可在浏览器里直接调 Gemini 并生成 API Key。2026-09-02 发布的 Gemini 3.8 Flash(gemini-3.8-flash,1M 上下文,促销价 $0.75/$3.75 每百万 tokens 至 2026-12-31 后涨回 $1.50/$7.50)已进入 AI Studio 模型选择器,免费层可限速试用;Google 已不公布静态 RPD/RPM 数字,需在 AI Studio 内查看。中国大陆不可用。
在边缘网络跑开源模型,免费档每天 10,000 Neurons(00:00 UTC 重置),无需绑卡。注意 kimi-k2.6/k2.7-code、glm-5.2/5.3、deepseek-v4-* 需付费账单,不在免费额度内。
NVIDIA 官方免费推理端点。官方 FAQ 明确:build.nvidia.com 上所有模型都可免费用于原型开发,约 40 RPM 且不按 token 计费。适合试跑各类开源大模型。
云端算力平台,Starter 计划每月赠送 30 美元计算额度,GPU 按秒计费(T4 约 $0.000164/秒起),含 3 席位、10 GPU 并发。适合跑推理与训练任务,需注册账号。
免费云端 Notebook,免费层无需信用卡。注意:官方未公布固定配额,GPU 不保证可得、按需分配,单次会话上限约 12 小时,不要指望稳定拿到卡。
免费单卡 NVIDIA Tesla P100(4 CPU / 29GB RAM),会话最长 12 小时、空闲 20 分钟断开。流传的「每周 30 小时」为第三方说法,官方文档未证实。
新用户每个模型赠送 100 万 Tokens,有效期 3 个月,仅抵扣在线推理。覆盖 17 个模型,含 ERNIE-4.5-Turbo-128K/32K/VL、ERNIE-X1-Turbo-32K、DeepSeek-R1/V3、Kimi-K2、Qwen3 系列与 bge 向量模型。
首次开通自动发放免费额度,每模型通常 100 万 Token(输入与输出各计),有效期 90 天、过期作废。领免费额度无需实名,但仅限华北 2(北京)地域,后续按量付费需实名。
官方价格页标注「免费」的模型:GLM-4.7-Flash(200K 上下文)与 GLM-4.6V-Flash,其余多为「限时免费」而非永久。网传「新用户送 2000 万 Token」未找到官方出处,不予采信。
腾讯云大模型服务平台,新主账号可一次性领取「新人免费体验包」:语言模型各独立额度(如 HY 2.0 Think 50 万 / DeepSeek-V3.2 50 万 / GLM-5 100 万 / Kimi-K2.5 50 万 / MiniMax-M2.5/2.7 各 100 万 Tokens),90 天有效、过期作废,活动截至 2026-12-31。OpenAI 兼容 API,腾讯云账号即可领取、无需绑卡。混元已并入 TokenHub,老「腾讯混元 API」入口同此。
商汤日日新 SenseNova
Token Plan 公测套餐,GLM-5.2 / DeepSeek-V4-Flash 等模型每 5 小时 500 次调用(各模型独立计量),无需绑卡即可调用。兼容 OpenAI / Anthropic 双格式接口(token.sensenova.cn/v1),最多 20 个 API Key。公测结束时间未公布,以官方控制台实时状态为准。
国家超算互联网
新用户注册即送 1000 万 Tokens(官方公告原文),GLM-5.2 / GLM-5.3 API Day-0 上线,免部署一键调用。覆盖 MiniMax-M2.5 / DeepSeek-V3.2 / Qwen3-235B 等开源与国产模型,用完按量付费。
联通云 AI 服务平台,GLM-5.2 Day-0 全链路同步上架,无需部署一键调用。新用户享平台免费试用,并开放 7 天百万 Tokens 免费额度体验(过期作废),用后转付费。企业级合规算力底座。
对所有注册用户免费提供 OpenAI 兼容托管推理 API(base_url https://api-inference.modelscope.cn/v1)。官方限流文档:每账号每日总计 2000 次调用、单模型最高 500 次(动态限流),需绑定阿里云账号并完成实名认证。请勿用于高并发 / SLA 线上任务。
有免费额度,但官方两个口径并存:开通后每模型赠送 50 万 tokens;活动页则写完成实名并关闭「安心体验」后每日单模型最高 200–500 万 tokens。参与每日额度需实名认证,建议以官方活动页为准。
⚠️ 免费范围存疑,接入前务必自行核验:多家第三方免费权益清单(2026-09)一致称硅基流动的对话类小模型永久免费已于 2026-09 取消,目前仅 embedding / 语音 / OCR / 翻译 / Kolors 等非对话模型免费,对话模型改为收费。本站 2026-09-28 尝试核验官方模型页时被跳转到登录页,无法从官方页面直接确认该变化,故原有「官方文档确认 Qwen2.5-7B 等多个大模型 API 可免费使用」的表述保留但可信度已下调,请以控制台内实时显示的免费清单为准。另:网传「注册送 2000 万 Token」未找到官方出处,已删除该说法。
月之暗面开放平台
完成个人或企业认证后赠送 15 元代金券。注意代金券不可用于旗舰模型 Kimi K3(需充值,最低 10 元),适合跑 K2 系列。2026-09-02 起 API 原生兼容 OpenAI Responses API 格式,使用 Codex 或 Claude Code 可直连 kimi-k3、kimi-k2.7-code,无需转换格式或本地代理。
自研晶圆级芯片,推理速度极快。注意:2026-07-21 起已取消永久免费层,改为注册并绑定验证支付方式后赠送 5 美元一次性免费额度,30 天过期、不续期,可访问全部 Cerebras 模型;额度用尽需按量付费(Developer 档 $10 起)。国际站点,中国大陆可用性不稳。
无需注册的开源多模态 API(文本 / 图像 / 音频),直接发请求即可用,适合原型与教学 Demo。官网称可通过 Quests 获得免费 Pollen,无公开固定额度,也无 SLA,别用于生产。
免费账号每月约 0.10 美元 Inference 额度(PRO 为 2 美元/月),额度内可用全部 Inference Providers 模型。额度很小,只够试调,不适合跑量。
可跑数千开源模型。官方仅称「可选模型能免费跑一会儿,之后会被要求设置账单」,无公开额度数字,也没有持续免费额度 —— 属于试用性质,跑量前先确认账单设置。
高性能开源模型推理 API,低延迟。新用户赠送 1 美元一次性免费额度(非续期),用完即按量计费。
统一调用开源模型 API。注意:2026-08-31 核验时官方定价页没有任何免费档或 $0 模型,第三方关于「$5/月免费」的说法互相冲突,免费额度无法确认,接入前请先核实。
图像 / 音视频 (21)
即梦 AI
字节旗下文生图与文生视频,每日赠送约 60–100 积分,生成消耗积分。注意免费产出带水印且不可商用,原「额度充足」的说法偏乐观。
可灵 AI
快手出品,文生视频质量高。每日赠送灵感值,视频生成消耗大、需排队。免费档生成内容不可商用,商用需开通会员。
通义万相
阿里图像生成模型。网页端每日约 50 灵感值可免费出图,图片无水印且可商用;视频生成较慢,商用条款以官网协议为准。
ChatGPT 内置图像生成,2026-09-08 已升级到 ChatGPT Images 2.5(对应 API 的 GPT-Image-2.5 Flare / Sunburst,延迟最高降低 50%,多轮编辑一致性提升;DALL·E 3 已于 2026-03 退役)。Images 2.5 向所有档位开放(含免费档),免费档额度约 2–3 张/24 小时(第三方口径,官方未公布数字)。输出带 C2PA 隐形水印,OpenAI 条款允许商用。中国大陆不可用。
文生音乐,免费档 50 credits/天(约 10 首)。两个重要限制:自 2026-09-03 起免费档不再提供歌曲下载;与 Sony / Universal 系诉讼仍在进行,免费档产出不可商用。
文生音乐,免费 10 credits/天 + 100/月,最多约 3 首全曲(2:10)/天。注意:与 UMG / WMG / Merlin 和解后下载(音频/视频/stems)过渡期被禁用;免费档不可商用,商用需 Pro($30/月)。
顶级 AI 语音合成与声音克隆,免费档 10,000 字符/月。注意免费档需署名,且不可商用。
AI 视频生成与编辑,Gen 系列模型能力强。Free 档 125 credits(一次性、不刷新),Gen 系列消耗高。官方称各档含商用与内容所有权,但免费档视频带 Runway 水印,实际难作商业交付。
文生与图生视频,上手简单。Basic($0)约 80 视频积分/月,480p,Pika 2.5。官方定价页列有无水印下载与商用,但第三方说法冲突,水印与商用条款请以官网为准。
游戏与概念美术方向的文生图,每日 150 Fast Tokens,免费生成为公开生成。官方 Help Center 称免费档可商用,但属非独占许可、平台对公开图保留广泛权利;私有生成与完整所有权需付费。
擅长图中文字渲染的文生图。官方定价 FAQ 称不主张输出所有权、免费档亦可商用(与部分第三方说法冲突,以官方为准)。免费额度官方未给出确切数字。
Vidu
生数科技视频生成模型,中文提示词友好。错峰模式可免费生成,注册与每日登录送积分;去水印与 720p 以上需付费,免费档带水印、商用条款未确认。
MiniMax 视频生成,每日约 60–100 credits(注册送 200),可出 720p。免费档带水印且不可商用。MiniMax H3 视频生成模型已于 2026-07-31 官方开源(GitHub MiniMax-AI/MiniMax-H3,2026-09-13 官方仓库核验:支持文本/图像/视频/音频输入、视频+原生立体声输出、最长 15 秒,官方托管最高 768P/2K)。
LiblibAI
国内 SD / Flux 模型在线出图社区。官方称免费用户每日赠送 20 积分,按模型授权商用。
PixVerse
轻量文生与图生视频,每日约 60 积分,540p / 5s,免费档带水印且不可商用。官方定价页未找到,额度以站内实际显示为准。
Stable Diffusion Online
网页版 SD 出图,无需本地部署。免费档有次数与分辨率限制,具体数值官方未公布;免费产出的商用条款亦无法确认。
Civitai
SD 模型与 LoRA 社区,可用 Buzz 在线出图,资源极多。免费额度官方未公布口径,第三方说法不一;商用条款无法确认。
零代码搭 AI Bot,个人免费版 0 元,可发布到多个平台。官方文档未列出免费版月度积分数额,去品牌水印需付费;生成内容的商用条款文档未明确。
Dify
开源 LLM 应用开发平台。开源版可自部署(Dify Open Source License,基于 Apache 2.0 修改),自部署可商用、多租户 SaaS 需商业授权;Cloud 沙箱免费约 200 条消息额度。
剪映 AI
抖音系剪辑工具。基础 AI 字幕、配音、成片与 1080P 无水印导出免费,部分高级 AI 功能需 SVIP。免费版素材的商用条款官方未单独声明。
会议与音视频转写、总结,中文表现好。上传文件每天免费 2 小时转写额度,当日耗尽需等 24 小时(这是本类目里唯一拿到官方明确数字的额度)。商用条款官方未声明。
编程助手 (21)
Free 档每月 2,000 次代码补全,含 Chat 与一份 AI 积分(官方未给数字),不含 Agent / MCP,且只能自动选模型、不能手选。学生、教师与知名开源维护者可免费申请 Pro。
品牌沿革:Codeium → Windsurf(2025-04)→ Devin Desktop(2026-06)。原 Codeium 已不复存在,codeium.com 与 windsurf.com 均跳转 devin.ai。Devin Free 档:无限 Tab 补全与无限 inline edits,另有轻量 agent 配额(官方未给数字),前沿模型需 Pro。
AI 原生代码编辑器,Hobby 免费档无需信用卡,可用 Composer 与有限 Agent 请求。2026 年起改为双用量池计费,官方定价页已不公布 Hobby 的具体次数与可用模型。
字节出品的 AI 编程 IDE,已升级为 TRAE(TraeCode / SOLO 双形态)。¥0 档每月 500 积分、全功能可用、2 个云端任务并发,中文体验好。
阿里 AI 编程工具,2026-05-20 起通义灵码已更名为 Qoder CN。个人社区版免费:每月有限补全与体验额度(具体数字未公开),需绑定阿里云主账号,可选 GLM / DeepSeek / Kimi / MiniMax 等模型。
Google 官方开源终端 Agent,个人 Google 账号即可用:每天 1,000 次请求、每分钟 60 次,支持 Gemini 3 与 1M 上下文。这是目前免费额度最实在的命令行 Agent 之一。
opencode
开源终端 / IDE / 桌面 Agent,内置免费模型可直接开用,也可接 75+ provider,还能复用已有的 Copilot 或 ChatGPT Plus 账号额度。
Rust 写的高性能编辑器,Personal 档永久免费:每月 2,000 次 edit predictions;若自带 API Key 则不限次数。
Aider
Python 写的终端 pair programming 工具,Apache 2.0。软件免费但需自备 API Key,接本地 Ollama 可做到零推理费。注意:末次提交 2026-05-22,近三个月维护放缓。
开源 VS Code / JetBrains / CLI 编程 Agent,平台费 $0。可用 Auto Free 走免费模型,也支持 BYOK 或本地模型,推理按实际用量另计。
开源 AI 编程插件,可接本地或自有模型,免费自部署。注意:不含任何赠送的模型额度,接 Claude / OpenAI / Gemini 需自备 Key,只有接 Ollama 本地模型才能做到零推理费。原「Continue」被收购后 Hub 与登录已下线,末次提交 2026-07-21。
用自然语言生成前端代码(已跳转 v0.app)。免费档:每月 5 美元积分、每天 7 条消息,可部署到 Vercel 并同步 GitHub。
浏览器内 AI 全栈开发。免费档:每天 30 万 tokens、每月 100 万 tokens,产出带 Bolt 水印,10MB 上传上限,数据库不限。
百度 AI 编程助手,个人标准版智能补全免费,首次赠送 10 元请求券;券用尽后没有免费兜底(Auto-Free 属付费档功能)。
华为云的 AI 代码智能体,形态含自有 AI IDE、JetBrains / VS Code 插件与 CLI/TUI,鸿蒙场景有 ArkTS 增训模型。2026-09-04 23:59 起套餐从「Token 套餐」升级为积分模式:体验版 ¥0/月(每月 500 积分,另可限时每日领 1,000 积分,领取后 1 个月内有效)、标准版 ¥98/月(2,000 积分)、高级版 ¥198/月(4,000 积分)、旗舰版 ¥498/月(10,000 积分);个人版新用户注册登录送 4,000 积分。付费套餐积分用尽可加购积分包(个人 1,000 积分包 ¥50/月),免费体验版积分用尽则不能再发起请求。模型积分消耗系数:GLM-5.2 0.7、GLM-5.2-ArkTS-SPARK 0.7、OpenPangu-2.0-Pro 0.7、OpenPangu-2.0-Flash 0.32。另并行「码力续航计划」限时福利:每日登录客户端可领 1,000 万免费 Token,额度当日有效、0 点清零不累计、仅限码道平台内使用(不可导出到自有 Agent 或第三方),领取后可自由切换限时福利模型 GLM-5.3-Flash / DeepSeek-V4-Pro-0813 / DeepSeek-V4-Flash-0731(福利模型会持续更新变换,以客户端可选清单与官方公告为准)。据 2026-09-11 客户端模型列表:限时福利分类为上述 3 个模型,内置分类为 GLM-5.2、GLM-5.2-ArkTS-SPARK、OpenPangu-2.0-Pro、OpenPangu-2.0-Flash(后两款为 2026-08-19 上线的盘古 OpenPangu-2.0 系列),并支持「添加模型」接自定义模型。限时福利为总量发放、发完即止。
美团 CatPaw
美团推出的 AI 编程 IDE(Agent 驱动),当前主要支持 macOS(Windows 预告上线),兼容 Python / C++ / Java / JS / TS / Go / Rust 等。公测阶段完全免费:新用户注册送 500 次高阶模型调用额度(每次与 AI 对话消耗 1 次),额度不足可在同位置提交续充申请;内置美团自研 LongCat 大模型,并支持 GLM-5.1、Kimi-K2.6、MiniMax-M2.7 等国内模型。注:需从官网社群获取邀请码才能下载。
智谱官方 AI 编程工作区(GLM 官方适配开发工具),多端支持:桌面端、手机 Remote、飞书 / 微信 Bot 可共推同一工作区任务。新用户首享 5 天免费体验,额度仅在这 5 天内每日发放、5 天后失效:每日 GLM-5.3 300 万 Token + GLM-5-turbo 200 万 Token(每日合计 500 万,2026-09-28 按 ZCode 官方文档核验)。订阅用户可创建「闲时任务」,由 ZCode 在算力富余时段免费执行、不消耗套餐额度。双节活动(下述口径已于 2026-09-30 由智谱官方文档「夜间畅用活动」公告页一手核验,见 https://docs.bigmodel.cn/cn/coding-plan/notice/event-glm-5.3-flash):官方原文明确活动时间为 2026-09-03 至 2026-10-07,并写明「活动截止时间已从 9 月 20 日延期至 10 月 7 日」—— 错峰时段(每日 23:00 至次日 09:00,含周末及公共假日)内,通过 ZCode(需 3.10 及以上版本)或 AutoClaw 调用 GLM-5.3-Flash 的额度消耗全部为 0,通过套餐支持的其他 Agent(如 Claude Code / Cline / OpenCode)使用则可用额度在标准规则基础上 ×2。官方文档的套餐概览页另有「庆双节活动」:2026-09-25 至 10-07 全天按非高峰时段规则消耗额度(非高峰按基础积分 50% 抵扣,高峰时段为每周一至周五 14:00–18:00)。注意:活动仅覆盖 GLM-5.3-Flash,错峰时段内选用 GLM-5.3 仍按套餐标准规则扣积分;若错峰时段内的使用已达 5 小时/周限额上限,将暂时无法参与本活动,待限额刷新后恢复。新上线的 GLM-5.3-FlashX 对 Coding Plan 用户滚动开放两周试用(最高 200 tokens/s,扣费为普通 Flash 的 2.5 倍)。活动均限时,以官方公告为准。API 走 Coding 专用端点 /api/coding/paas/v4,OpenAI 兼容。
智谱推出的开箱即用本地桌面智能体(一键安装 OpenClaw 桌面版),内置 Pony-Alpha-2 专属 Agent 模型与 50+ 预置技能,支持浏览器自动化、飞书 / 微信 / 企业微信接入,可在本地执行代码、做数据分析与文档生成。基础功能免费使用并提供每日免费积分额度;新用户注册赠送约 2000–3000 积分,可用 GLM 系列等模型,用完后可买付费积分包或接入自有 API Key(DeepSeek / GLM / Kimi 等)按各模型定价计费。桌面端支持 macOS / Windows,移动端 iOS / Android 可查看与触发任务。双节时段 AutoClaw 同步适用智谱 GLM Coding Plan 的夜间畅用活动:2026-09-03 至 10-07 每天 23:00–次日 09:00 调用 GLM-5.3-Flash 额度消耗为 0(官方公告页明确原定 9-20 结束、已延期至 10-07),2026-09-25 至 10-07 全天按非高峰时段规则消耗额度(上述活动口径已于 2026-09-30 由智谱官方文档「夜间畅用活动」公告页一手核验,见 https://docs.bigmodel.cn/cn/coding-plan/notice/event-glm-5.3-flash;第三方清单另称 AutoClaw 已不碰 Git,与 ZCode 的数据上传争议可区分对待)。另需注意:多家第三方免费权益清单(2026-09)称 AutoClaw 的无门槛免费档已结束、转为付费会员专属档(每日 0 点登录可领当日失效的积分、封顶约 8000 万 Token/天),新用户注册赠送额度为 1 亿且长期有效 —— 该口径与本站此前记录的「注册送约 2000–3000 积分」不一致,且无官方页面可核验,请以 AutoClaw 官方页面实时显示为准。
腾讯云代码助手(原腾讯云 AI 代码助手),覆盖插件、IDE、CLI 三端,提供 Craft 开发智能体、AI 对话、代码补全、单元测试、智能评审、工程理解、MCP Server 等,支持 200+ 编程语言与数十款主流 IDE。个人版免费使用(含代码实时续写、注释生成代码、智能技术对话、生成单元测试等);个人专业版限时免费(原价 ¥59/月)。国内版已接入 DeepSeek-V4.1-Flash(2026-09-10 DeepSeek 官方公告:WorkBuddy 含 CodeBuddy 作为官方合作伙伴已全量接入)与腾讯混元 Hy4 preview 等系列模型,国际版支持 Claude / GPT / Gemini 等(国际版需邀请码)。具体可选模型清单以客户端内为准。
开放原子开源基金会 / CSDN 旗下 AtomGit 推出的开源终端 AI 编码助手(Rust 构建,Claude Code 开源平替),全平台支持。通过 AtomGit CodingPlan 免费领取额度:Lite 档 30 天免费(deepseek-v4-flash、Qwen3-VL-8B 等,每日限量 1000 人领取);Pro 体验版 7 天免费(每日 10:00 限量 100–150 人,额外支持 GLM-5.2);Pro 档 30 天免费但需合入 PR。额度按 5 小时滚动窗口计量(非月总额度),日常几乎用不完。MIT 开源、无订阅门槛、可商用;也可接入自有 API Key。
讯飞 iFlyCode
科大讯飞推出的智能编程助手(星火飞码),基于星火大模型,覆盖代码生成 / 补全 / 解释 / 纠错 / 单元测试 / SQL 优化 / 代码评审全流程,支持 VS Code、JetBrains IDE 等。免费版(个人开发者)每日 50 次 AI 生成额度,适合日常探索;企业版按席位计费(约 ¥980/月/席位)并支持私有化部署(等保三级、数据不出域),适配政务 / 金融合规场景。中文语义理解优化(本土术语准确率约 98%)。