ar
Feedback
QIN2DIM's Tech Channel

QIN2DIM's Tech Channel

الذهاب إلى القناة على Telegram
378
المشتركون
-224 ساعات
+27 أيام
لا توجد بيانات30 أيام
أرشيف المشاركات
小米 18 Pro 系列开售 5999 元起 小米 18 Pro 系列现已开售, 12GB+256GB 起售价 5999 元,定位双尺寸影像科技旗舰。 新机搭载新一代 2nm 骁龙 8 至尊版平台,配备徕卡 2 亿大底主摄与长焦,至高 8500 mA
小米 18 Pro 系列开售 5999 元起 小米 18 Pro 系列现已开售, 12GB+256GB 起售价 5999 元,定位双尺寸影像科技旗舰。 新机搭载新一代 2nm 骁龙 8 至尊版平台,配备徕卡 2 亿大底主摄与长焦,至高 8500 mAh 电池,并支持硬件级防窥屏和 AI 百变背屏。
小米 18 Pro 12 GB+256 GB:5999 元 12 GB+512 GB:6999 元 16 GB+512 GB:7999 元 16 GB+1 TB:8999 元 小米 18 Pro Max 12 GB+256 GB:定价 6999 元; 12 GB+512 GB:定价 7999 元; 16 GB+512 GB:定价 8999 元; 16 GB+1 TB:定价 9999 元。
小米公司 🌸 科技圈· 茶馆 · 投稿

日活超 2 亿的豆包收缩对话团队:主要团队减员近半 日活超 2 亿的 AI 应用豆包开始收缩对话团队:通用 Session 团队约 50 人,预计减员约一半,部分人员转岗至豆包商业化、飞书等团队,其余被裁撤;对话方向的产品后训练团队也在缩减。 此举与对话产品商业化瓶颈有关。今年 4 月付费版消息传出后,用户集中抱怨豆包回答“又蠢又讨好”,豆包最终决定接受短期留存下滑以纠正体验,留存指标短期下滑不到 1%。 晚点 LatePost 🌸 科技圈· 茶馆 · 投稿

photo content

🤖 Anthropic 发布 Claude Opus 5.5,成本降 40% Anthropic 发布 Claude 5.5 系列首款模型 Claude Opus 5.5,多数任务表现与 Fable 5.1 相当,运行成本比 Opus 5 低 40
🤖 Anthropic 发布 Claude Opus 5.5,成本降 40% Anthropic 发布 Claude 5.5 系列首款模型 Claude Opus 5.5,多数任务表现与 Fable 5.1 相当,运行成本比 Opus 5 低 40%,输出提速超 30%。 新模型在自动化行为审计中取得迄今最佳成绩,并配齐网络安全、生物等领域防护。Claude Sonnet 5.5 和 Haiku 5.5 将在未来数周发布。 AnthropicAI 🌸 科技圈· 茶馆 · 投稿

《CCFA 你不发有的是人发》 🚑 https://x.com/galaxy1025850/status/2102086674931196356?s=20
《CCFA 你不发有的是人发》 🚑 https://x.com/galaxy1025850/status/2102086674931196356?s=20

photo content

全员酥化

自宇宙大爆炸到去年为止,所有的 ICLR 投稿数目加起来都没有。今年的 ICLR 投稿数目多。
+2
自宇宙大爆炸到去年为止,所有的 ICLR 投稿数目加起来都没有。今年的 ICLR 投稿数目多。

小米 18 Pro 系列定于 9 月 23 日发布 雷军宣布,全新小米 18 Pro 系列将于 9 月 23 日晚 7 点发布。新品主打双尺寸影像旗舰,首发搭载全新小米澎湃 OS 4,并配备百变背屏;多款科技新品将同场亮相。 雷军 🌸 科技圈· 茶
小米 18 Pro 系列定于 9 月 23 日发布 雷军宣布,全新小米 18 Pro 系列将于 9 月 23 日晚 7 点发布。新品主打双尺寸影像旗舰,首发搭载全新小米澎湃 OS 4,并配备百变背屏;多款科技新品将同场亮相。 雷军 🌸 科技圈· 茶馆 · 投稿

Jev 的选择、二分类、评分的类似模式我在蛮久以前就 apply 到底层应用里了,穿插在决策流中,完全抛弃RAG,面对数以万计的选择时用小模型以毫秒级决策速度来辅助推进分层搜索和波束赋形。 不太清楚其他人搭建的 agent strategy 是怎么设
Jev 的选择、二分类、评分的类似模式我在蛮久以前就 apply 到底层应用里了,穿插在决策流中,完全抛弃RAG,面对数以万计的选择时用小模型以毫秒级决策速度来辅助推进分层搜索和波束赋形。 不太清楚其他人搭建的 agent strategy 是怎么设计的。我最常用的是qwen的 35B-A3B 模型,A100 推理 BF16,开 spec和调一些其他优化,请求时关闭思考,15k以内长输入短输出场景的 structured output duration 基本都是单请求 100~500ms,TTFT 100ms左右, 还能处理多模态请求。 比较遗憾的是并发量很低,稍长的请求就会触发repeat,但瑕不掩瑜。 如果同样是 A100 等效算力来部署 jev,并发量可能可以去到 3 位数甚至更高。而且看起来 jev 的激活参数量要小于 3B,能进一步降延迟压到 50ms,甚至比网络延迟都要低,这对没接触过类似用法的用户绝对是一个惊喜。

🤤

QIN2DIM's Tech Channel - إحصائيات وتحليلات قناة تيليجرام @qin2dim