<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>大模型 on Huoke.Me - 跨境生活，从理财开始！</title><link>https://blog.huoke.me/tags/%E5%A4%A7%E6%A8%A1%E5%9E%8B/</link><description>Recent content in 大模型 on Huoke.Me - 跨境生活，从理财开始！</description><generator>Hugo</generator><language>cn</language><lastBuildDate>Fri, 24 Apr 2026 09:59:00 +0800</lastBuildDate><atom:link href="https://blog.huoke.me/tags/%E5%A4%A7%E6%A8%A1%E5%9E%8B/index.xml" rel="self" type="application/rss+xml"/><item><title>Kimi K2.6 开源：1万亿参数 MoE，激活仅 32B</title><link>https://blog.huoke.me/posts/kimi-k2-6/</link><pubDate>Fri, 24 Apr 2026 00:48:49 +0800</pubDate><guid>https://blog.huoke.me/posts/kimi-k2-6/</guid><description>&lt;blockquote>
&lt;p>🎯 &lt;strong>一句话：Kimi K2.6 用 1 万亿参数、32B 激活、300 智能体，开源正面刚 GPT-5.4。&lt;/strong>&lt;/p>&lt;/blockquote>
&lt;hr>
&lt;h2 id="-基本信息">📌 基本信息&lt;/h2>
&lt;table>
 &lt;thead>
 &lt;tr>
 &lt;th>项目&lt;/th>
 &lt;th>参数&lt;/th>
 &lt;/tr>
 &lt;/thead>
 &lt;tbody>
 &lt;tr>
 &lt;td>&lt;strong>模型名称&lt;/strong>&lt;/td>
 &lt;td>Kimi K2.6&lt;/td>
 &lt;/tr>
 &lt;tr>
 &lt;td>&lt;strong>发布方&lt;/strong>&lt;/td>
 &lt;td>Moonshot AI（月之暗面）&lt;/td>
 &lt;/tr>
 &lt;tr>
 &lt;td>&lt;strong>发布日期&lt;/strong>&lt;/td>
 &lt;td>2026-04-20&lt;/td>
 &lt;/tr>
 &lt;tr>
 &lt;td>&lt;strong>开源状态&lt;/strong>&lt;/td>
 &lt;td>✅ 完全开源（含权重）&lt;/td>
 &lt;/tr>
 &lt;tr>
 &lt;td>&lt;strong>上下文长度&lt;/strong>&lt;/td>
 &lt;td>256,000 tokens&lt;/td>
 &lt;/tr>
 &lt;tr>
 &lt;td>&lt;strong>多模态&lt;/strong>&lt;/td>
 &lt;td>✅ 原生支持（文本 + 图像）&lt;/td>
 &lt;/tr>
 &lt;tr>
 &lt;td>&lt;strong>定价（OpenRouter）&lt;/strong>&lt;/td>
 &lt;td>输入 $0.56/M tokens，输出 $3.50/M tokens&lt;/td>
 &lt;/tr>
 &lt;/tbody>
&lt;/table>
&lt;p>&lt;img src="https://blog.huoke.me/img/posts/kimi-k2-6/architecture.svg" alt="Kimi K2.6 架构总览" loading="lazy" decoding="async">

&lt;em>图1：K2.6 的参数规模与核心能力概览。1T 总参数、32B 激活、300 个智能体协同，对标 GPT-5.4 与 Claude Opus 4.6。&lt;/em>&lt;/p>
&lt;hr>
&lt;h2 id="-技术架构1万亿参数为何只激活-32b">⚙️ 技术架构：1万亿参数，为何只激活 32B？&lt;/h2>
&lt;p>K2.6 采用 &lt;strong>MoE（Mixture of Experts）混合专家架构&lt;/strong>，这是实现「超大参数、小激活」的核心。&lt;/p>
&lt;h3 id="关键数据">关键数据&lt;/h3>
&lt;ul>
&lt;li>&lt;strong>总参数量&lt;/strong>: 1 万亿（1T）参数&lt;/li>
&lt;li>&lt;strong>激活参数量&lt;/strong>: 约 32B（每次推理只激活 3.2% 参数）&lt;/li>
&lt;li>&lt;strong>专家数量&lt;/strong>: 300 个并行子专家网络&lt;/li>
&lt;li>&lt;strong>协调步数&lt;/strong>: 最多 4000 步任务分解与协调&lt;/li>
&lt;li>&lt;strong>上下文窗口&lt;/strong>: 256K tokens（约 20 万汉字或 50 页 PDF）&lt;/li>
&lt;/ul>
&lt;h3 id="moe-工作原理">MoE 工作原理&lt;/h3>
&lt;p>传统 dense 模型每个 token 都要经过全部 1T 参数，计算量巨大。K2.6 MoE 的每个 token 只路由到 2–4 个专家子网络，计算量控制在 32B 激活。&lt;/p></description></item><item><title>Elephant Alpha 免费薅羊毛：半小时撸出一个 AI 小秘书</title><link>https://blog.huoke.me/posts/elephant-alpha/</link><pubDate>Fri, 17 Apr 2026 00:00:00 +0800</pubDate><guid>https://blog.huoke.me/posts/elephant-alpha/</guid><description>&lt;blockquote>
&lt;p>🎯 Elephant Alpha 在 OpenRouter 完全免费，100B 参数 + 256K 上下文，速度快到离谱。半小时撸出一个 AI 小秘书。&lt;/p>&lt;/blockquote>
&lt;hr>
&lt;h2 id="-elephant-alpha-是什么">📌 Elephant Alpha 是什么&lt;/h2>
&lt;p>最近 Timeline 上很多人在聊的神秘大模型，目前在 OpenRouter 完全免费。100B 参数、256K 超长上下文，配置在免费模型里算不错了。&lt;/p>
&lt;p>👉 模型地址：https://openrouter.ai/openrouter/elephant-alpha&lt;/p>
&lt;hr>
&lt;h2 id="-实测感受">⚙️ 实测感受&lt;/h2>
&lt;p>&lt;strong>速度是最大亮点。&lt;/strong> 不同于一般模型明显的流式吐字，它几乎是瞬发内容，体感像开了加速器。高频调用、轻量 Agent 场景下的绝对首选。&lt;/p>
&lt;p>&lt;strong>编码能力尚可。&lt;/strong> 虽不及 Claude 细腻，复杂逻辑建议 Claude 接力，但半小时撸出一个 MVP 流程毫无压力。&lt;/p>
&lt;p>&lt;strong>日常任务表现。&lt;/strong> 在日常对话和轻量任务中，跟 Claude/GPT 这些 SOTA 模型差距不大。&lt;/p>
&lt;hr>
&lt;h2 id="-半小时撸出的-ai-小秘书">💰 半小时撸出的 AI 小秘书&lt;/h2>
&lt;p>用 Elephant Alpha 在 Hermes 上搭了一个小秘书，功能很简单：&lt;/p>
&lt;ul>
&lt;li>自然语言录入待办&lt;/li>
&lt;li>定时提醒推送到 Telegram&lt;/li>
&lt;li>每日 AI 自动摘要复盘&lt;/li>
&lt;/ul>
&lt;p>整个流程半小时跑通，用起来很丝滑。AI 不只是聊天工具，记事、催办、总结这些场景才是普通人最实用的价值。&lt;/p>
&lt;blockquote>
&lt;p>⚠️ 这套流程需要安装 Hermes Agent。Mac 上可以用本地部署模型，完全免费，只要电脑够给力。&lt;/p>&lt;/blockquote>
&lt;hr>
&lt;h2 id="-faq">❓ FAQ&lt;/h2>
&lt;p>&lt;strong>Q：Elephant Alpha 是哪家的模型？&lt;/strong>&lt;/p></description></item></channel></rss>