<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"><channel><title>devtake.dev — Llama</title><description>Articles on devtake.dev covering Llama.</description><link>https://devtake.dev/</link><language>en-us</language><item><title>One model per chip: AMD bought Taalas, whose test part hit 17,000 tokens a second</title><link>https://devtake.dev/article/amd-taalas-hardwired-model-silicon/</link><guid isPermaLink="true">https://devtake.dev/article/amd-taalas-hardwired-model-silicon/</guid><description>Taalas casts a model&apos;s weights into transistors. Its 6nm test chip served Llama 3.1 8B at roughly 17,000 tokens per second, and AMD just bought the company.</description><pubDate>Mon, 10 Aug 2026 08:30:00 GMT</pubDate><category>hardware</category><category>amd</category><category>ai-chips</category><category>custom-silicon</category><category>semiconductor</category><category>ai-infrastructure</category><category>acquisitions</category><category>nvidia</category><category>hardware</category><author>hiro-tanaka</author></item><item><title>Arcee&apos;s Trinity-Large-Thinking is a 399B open MoE that costs 96% less than Opus</title><link>https://devtake.dev/article/arcee-trinity-large-thinking-reasoning/</link><guid isPermaLink="true">https://devtake.dev/article/arcee-trinity-large-thinking-reasoning/</guid><description>Arcee released Trinity-Large-Thinking on April 1: a 399B-param sparse MoE with 13B active, Apache 2.0 weights, $0.88 per million output tokens, and PinchBench just behind Opus 4.6.</description><pubDate>Mon, 27 Apr 2026 13:00:00 GMT</pubDate><category>open-source</category><category>arcee</category><category>trinity</category><category>llm</category><category>ai-models</category><category>open-weights</category><category>moe</category><category>reasoning</category><category>apache-2-0</category><author>soren-vanek</author></item></channel></rss>