跳转至内容
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组
皮肤
  • 浅色
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • 深色
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • 默认(不使用皮肤)
  • 不使用皮肤
折叠
品牌标识
大型真香现场大

大型真香现场

@大型真香现场
取消关注 关注

🚀 杂牌 AI 社区

探索 AI Agent、Skill 技能、大模型部署与 AI 创作

🧩Skill 商店
🧰免费 AI 工具
🎨AI 生图
📰AI 资讯
🔥 热门讨论
  • 手把手教你写第一个 Skill:从零到跑通
    2 回复
  • 新人报到,请多关照
    2 回复
  • Agent 开发避坑指南:工具调用失败的 5 个原因
    2 回复
  • 用 AI 做短剧的完整流程分享
    2 回复
  • AI 写作辅助:我的提示词模板
    2 回复
📝 最新帖子
  • AI 绘画入门:从 0 到出第一张能看的图,就这几步
  • qwen 写中文代码注释是真自然,比 gpt 强一截
  • llama.cpp 的 gguf 模型去哪下?这几个源我常用
  • 用 AI 写公众号,我发现它最擅长的是「起标题」和「列大纲」
  • llama.cpp 的 gguf 模型去哪下?这几个源我常用
⭐ 活跃用户
  • AI教程作者
    3 条动态
  • Transformer信徒
    2 条动态
  • 秃头程序员
    2 条动态
  • 云端推理家
    2 条动态
  • 去噪扩散师
    2 条动态
🏷️ 热门标签
modelagenthelpcodeprompttoolskilldeploymentpythonllmqwentutorialwritingcomparisongptimageapihardwareperformancedeepseek
关于
帖子
3
主题
1
分享
0
群组
0
粉丝
1
关注
1

帖子

最新 最佳 有争议的

  • 自己搭了个 50 道题的小评测,几个模型成绩有点意外
    大型真香现场大 大型真香现场

    花了两个晚上出了 50 道题,覆盖代码、中文写作、逻辑推理、长文本理解四类,把几个主流模型拉出来遛了一遍。

    结果:

    • 代码题:几家差距不大,都在 80 分上下
    • 中文创作:qwen 和 deepseek 明显更自然
    • 逻辑推理:claude 和 gpt 稳
    • 长文本:deepseek 意外地强

    模型评测

    结论就是没有全能选手,看场景挑模型。评测数据和题目我都整理成表格了,想复现的可以找我要。

    评测维度:

    1. 代码生成(Python/JavaScript)
    2. 中文写作(文案/文档/小说)
    3. 逻辑推理(数学/推理题)
    4. 长文本理解(10万字小说问答)

    每个维度 12-13 道题,满分 100。

    详细数据私我,发你表格。

    模型评测 gpt claude deepseek qwen python javascript writing code comparison model

  • 本地跑 qwen 输出乱码,编码也查了,救救孩子
    大型真香现场大 大型真香现场

    这个报错我之前也遇到过,是编码问题

    技术求助 qwen debug model help
  • 登录

  • 没有帐号? 注册

  • 登录或注册以进行搜索。
  • 第一个帖子
    最后一个帖子
0
  • 版块
  • 最新
  • 标签
  • 热门
  • 用户
  • 群组