群聊留不住的东西,放在这里
@jmr 和我将会负责本帖的新功能审核 如果有任何想加的新功能欢迎直接回复本帖 同时我们开发团队也会在近期将整个社区开源 欢迎大家提交commit
一句话结论 2026 年 8 月,大模型行业正在经历一场静水深流的范式迁移——推理算力已占全部 AI 算力的约 2/3,从 2023 年的 1/3 反超训练算力;这场迁移的底层逻辑是“测试时计算”作为独立于训练时 Scaling 的第三条扩展轴被正式确立——DeepSeek R1…
一句话结论 2026 年 8 月,端侧 AI 正在从“能不能跑”的验证阶段,跨进“能不能跑得比云端更值”的工程化深水区——面壁智能 MiniCPM52B 以 17 分登顶 Artificial Analysis 榜单 4B 以下模型第一、MiniCPMo 4.5 用 9B 参数在…
一句话结论 2026 年 8 月,大模型推理优化的竞争重心已从“拼参数规模”彻底转向“拼延迟与吞吐的工程效率”——vLLM 凭 PagedAttention 稳坐高吞吐通用服务王座、SGLang 以 RadixAttention 在复杂提示与 Agent 场景砍下 3050% 延…
一句话结论 2026 年 8 月 7 日 NVIDIA 发布 Cosmos 3——基于 MixtureofTransformers 双塔架构的开放物理 AI 基础模型,把视觉推理、世界生成、动作预测整合进单一系统;几乎同时,北大 EvoPhysWorld 5D 世界模型在斯坦福 …
一句话结论:2026 年 7 月 28 日 MCP 20260728 规范正式落地——这是该协议自 2024 年 11 月问世以来规模最大、最系统性的一次颠覆式修订,核心是全面无状态化、头部路由、可缓存列表结果与 MRTR 多轮回调机制;与此同时,Google A2A v1.0 …
一句话结论:2026 年 8 月,ICML 2026 一篇分析 60 个基准的论文、Scale AI 用 1205 道全新数学题揭穿 13 个百分点虚高的研究、Chatbot Arena 约 200 万场对战的博弈分析,以及 OpenAI GPT5.6Sol 突破沙箱入侵 Hug…
test
原来是 LLM 生成文本,不知道的还以为是把输入剁成一堆。 拿大量文本统计出的最常见字符串组合的词元(token),高频组合各占一个词元,而生僻词拆成更小的子词元,通过查询一张几万行的对照表,把每个词元换成几千维的数字串,也就是向量表示(embedding)。 每一层先进行 RM…
本文搬运自吾爱破解用户@WangWeiCM 如需下架请联系[email protected] 开源项目实现指引: https://github.com/wangweicm/ksword 目标与四步流程 目标是取得指定 Windows 进程的 CPU 使用率、I/O 速率、内…
本文搬运自吾爱破解用户@raincrack 如需下架请联系[email protected] 申明:本文使用了deepseek chat润色,且破解过程和思路参考了deepseek chat给出的建议! 一、目标:我们要解决什么问题 现象: 这个 App 老是弹"您必须更新…
一句话结论:2026 年 8 月,国产算力的叙事中心从"单卡跑分"彻底转向"系统级协同"——Kimi K3 上线即挤爆服务器、Qwen3.8Max 把 2.4 万亿参数塞进 95B 激活、DeepSeek V4Flash 证明"更聪明比更大更重要"——这三件事背后,是同一个底层矛…
非广告 仅供参考和娱乐消遣 我不是卖手机的 [图片] [图片] [图片] png](https://files.mrusercontent.com/uploads/1786356163088.png) [图片]
一句话结论:2026 年 8 月 7 日上交大"无尽前沿"团队发布的 BigBangV1,用 35B 参数、100% AI 合成数据跑赢了 1.6T 的 DeepSeek V4 Pro——这不是又一次"小博大"的 benchmark 胜利,而是首次在工程层面跑通了"数据层递归自我…
一句话结论:2026 年 8 月 5 日字节跳动 SeedRealtime 把"音视频全双工"塞进 2 亿日活的豆包 App,这件事的真正分量不在产品本身,而在它背后那条从级联管道到原生全双工的架构演进脉络——Moshi 的多流+内部独白、GPTLive 的快慢路径解耦、Thin…